GPT Image 1.5 : comment créer des photos IA qui paraissent réelles

GPT Image 1.5 est ce que l’IA a produit de plus proche d’un vrai appareil photo. Cet article détaille les structures de prompt, le vocabulaire photographique, les termes d’éclairage et les approches propres à chaque sujet qui distinguent les images réalistes de celles qui ne le sont clairement pas.

GPT Image 1.5 : comment créer des photos IA qui paraissent réelles
Cristian Da Conceicao
Fondateur de Picasso IA

GPT Image 1.5 ne donne pas la même impression que la plupart des modèles d’IA de génération d’images. Il ne génère pas le rendu. Il photographie. La différence est subtile jusqu’à ce que vous la voyiez, et ensuite vous ne pouvez plus l’ignorer : la façon dont la peau capte la lumière, la façon dont un arrière-plan flou donne encore l’impression d’un espace physique, la façon dont les objets ont du poids. Cet article explique comment réduire l’écart entre « clairement de l’IA » et « pourrait être une photo » avec GPT Image 1.5, et vous donne les cadres exacts pour y parvenir.

Ce qu’est vraiment GPT Image 1.5

Bien plus qu’un simple modèle de texte vers image

La plupart des générateurs d’images sont entraînés à produire des résultats esthétiques. GPT Image 1.5 est entraîné à produire des résultats fidèles. Il est issu du pipeline de recherche multimodale d’OpenAI, la même lignée qui a donné à GPT-4o sa capacité à raisonner sur des entrées visuelles. Ce contexte compte : le modèle a été exposé à la façon dont la photographie réelle fonctionne (distorsion de perspective, comportement des objectifs, décroissance de la profondeur, brume atmosphérique), et pas seulement à l’apparence des photos.

Le résultat est un modèle qui gère la logique photographique mieux que presque toutes les autres options disponibles. Demandez-lui un portrait à 85 mm et il comprimera subtilement l’arrière-plan comme le ferait réellement un 85 mm. Demandez une lumière du matin et il calculera où tombent les ombres sous cet angle. Ce n’est pas un comportement accidentel : c’est une compréhension apprise de la réalité physique.

Photographe examinant des portraits photo générés par IA sur un écran professionnel dans un studio faiblement éclairé

En quoi il diffère des versions précédentes

Les anciens modèles d’image d’OpenAI excellaient dans l’illustration, le concept art et la narration visuelle. GPT Image 1.5 déplace nettement l’accent vers le photoréalisme et le respect des instructions. Là où DALL-E 3 pourrait interpréter « une femme qui lit près d’une fenêtre » avec une douceur picturale, GPT Image 1.5 la rend avec une précision documentaire : le grain du rebord en bois, le léger reflet dans la vitre, la façon dont ses cheveux tombent en trois dimensions.

Il gère aussi de manière plus réfléchie l’espace négatif et la composition. Le modèle semble comprendre que ce qui n’est pas dans le cadre compte autant que ce qui y est. C’est une intuition photographique dont manquent la plupart des autres modèles.

Pourquoi les photos IA paraissent encore fausses

Les 5 signes révélateurs

Même avec les meilleurs modèles, la plupart des images IA échouent au test du réel. Voici pourquoi :

ProblèmeÀ quoi ça ressemblePourquoi ça arrive
Peau trop lisseTexture de plastique, aucun poreLes modèles lissent les imperfections
Flou d’arrière-plan uniformeLe flou de fond est parfaitement régulierAucune compréhension de l’optique des objectifs
Logique d’ombre incorrecteOmbres issues d’angles impossiblesModélisation incohérente de la source lumineuse
Reflets étranges dans les yeuxReflets symétriques ou artificielsInterpolés à partir de plusieurs sources
Composition trop parfaiteCentrée, statique, propre comme sur InstagramBiais d’entraînement vers des images « jolies »

Deux photos imprimées côte à côte : l’une générée par IA avec de subtils artefacts, l’autre une vraie photographie argentique au grain organique

Ce que le modèle ne peut pas corriger seul

GPT Image 1.5 corrige automatiquement beaucoup de ces problèmes, en particulier la logique des ombres et le comportement des objectifs. Mais la texture de la peau, la variété des compositions et le grain sont des domaines où le prompt porte l’essentiel du travail. Le modèle n’ajoutera pas d’imperfections si vous ne le lui demandez pas. Il ne photographiera pas depuis un angle bas si vous n’en précisez pas un. Il n’ajoutera pas de grain argentique si vous ne nommez pas la pellicule. Vous devez parler sa langue.

💡 L’idée essentielle : les vraies photos sont imparfaites. Vos prompts doivent demander explicitement cette imperfection. Si votre prompt sonne comme un texte publicitaire, le résultat ressemblera à une photo de banque d’images.

Construire un prompt photoréaliste

La formule de base du prompt

La meilleure amélioration que vous puissiez apporter à vos prompts consiste à ajouter quatre couches de précision : le sujet, l’environnement, la lumière et la caméra. La plupart des gens soignent le sujet et négligent les trois autres.

[Subject with natural imperfection] + [Specific environment with texture details] + [Named light source, direction, and quality] + [Camera model, lens, f-stop, ISO] + [Film stock or color grade] + [--ar 16:9 --style raw]

Voici un avant et un après :

Faible : Une femme assise près d’une fenêtre

Fort : Une femme de fin vingtaine, avec des taches de rousseur naturelles et des cheveux légèrement ébouriffés par le vent, assise à côté d’une baie vitrée du sol au plafond dans un appartement minimaliste de Tokyo à 4PM, par un jour couvert, une lumière grise diffuse éclairant la scène par la gauche sans ombres marquées, prise avec un Sony A7IV et un objectif 85mm f/1.8, gradation colorimétrique Kodak Portra 400, grain de pellicule visible, --ar 16:9 --style raw

Le second prompt ne laisse aucune place au modèle pour retomber sur quelque chose de générique.

Femme aux cheveux châtain ondulés tapant des prompts détaillés sur un ordinateur portable dans un home studio ensoleillé

Le langage de la caméra et des objectifs qui fonctionne

C’est l’outil le moins exploité de l’ingénierie de prompt pour le photoréalisme. Des objectifs différents produisent des images fondamentalement différentes, et GPT Image 1.5 comprend ces différences.

ObjectifEffetIdéal pour
24 mm f/2.8Grand angle, légère distorsion sur les bordsArchitecture, intérieurs, environnement
50 mm f/1.8Perspective naturelle, compression plateRue, documentaire, portraits décontractés
85 mm f/1.4Arrière-plan compressé, beau bokehPortraits intimes, gros plans
135 mm f/2.0Forte compression, faible profondeur de champPortraits centrés sur le détail, sujets éloignés

Associez toujours l’objectif à un vrai boîtier d’appareil photo : Sony A7IV, Nikon Z8, Canon R5, Leica M11. Cela ancre le modèle dans les conventions de la photographie professionnelle plutôt que dans des esthétiques « photo » génériques.

Gros plan en contre-plongée d’un objectif Sony 85 mm f/1.4 GM posé sur un sac photo en cuir usé, avec un arrière-plan automnal en bokeh

Le vocabulaire de l’éclairage qui change tout

« Une belle lumière » est la formule la plus inutile de l’ingénierie de prompt. Un vocabulaire d’éclairage précis produit des résultats précis, qui paraissent réels.

Utilisez ce vocabulaire :

  • Direction : depuis le haut à gauche, depuis directement derrière, depuis un angle bas à 30 degrés
  • Qualité : soleil direct et dur, diffusion douce de ciel couvert, lueur chaude de lampes à incandescence en intérieur, rayons volumétriques de l’heure dorée
  • Interaction avec le sujet : créant un halo naturel à travers les cheveux, projetant des ombres en relief sur les pommettes, remplissant la scène d’un rebond ambiant depuis un mur blanc
  • Température de couleur : lumière du jour à 5500 K, chaleur de bougie à 2800 K, la qualité bleu-gris d’un matin d’hiver

💡 Astuce pro : combinez une source de lumière principale avec un remplissage secondaire, exactement comme le ferait un vrai photographe. Exemple : « Lumière principale : soleil d’après-midi dur venant de la droite, créant des ombres marquées. Remplissage : rebond ambiant doux depuis un sol en béton clair. »

Belle femme en robe blanche debout dans un champ de blé doré au lever du soleil, éclairée à contre-jour par des rayons chauds créant un halo naturel dans les cheveux

Utiliser GPT Image 1.5 sur PicassoIA

GPT Image 1.5 est disponible directement sur PicassoIA, où vous pouvez l’utiliser sans accès API, sans configuration de facturation ni environnement de développement. Voici comment tirer le meilleur parti du modèle sur la plateforme.

Configuration pas à pas

  1. Ouvrez la page du modèle : rendez-vous sur GPT Image 1.5 sur PicassoIA et cliquez sur Generate
  2. Rédigez votre prompt en suivant la formule ci-dessus : sujet + environnement + lumière + caméra
  3. Réglez le format sur 16:9 pour les scènes cinématographiques, 4:5 pour les portraits, 1:1 pour les photos de produits
  4. Ajoutez des modificateurs de style à la fin : --style raw signale le photoréalisme plutôt que l’illustration
  5. Lancez et évaluez : cherchez les signes révélateurs de l’IA listés plus haut. Si vous voyez une peau uniforme, relancez avec un vocabulaire de texture explicite

Réglages et paramètres à essayer

Quelques combinaisons qui donnent régulièrement de bons résultats :

  • Portraits : vocabulaire 85 mm + lumière de fenêtre + Kodak Portra 400 + pores ou taches de rousseur visibles
  • Environnements : grand angle + lieu nommé + météo ou moment de la journée précis + grain de film
  • Produits : macro en plongée + surface nommée en marbre ou en bois + lumière de studio douce venant du haut

💡 Le modèle respecte bien les descriptions négatives. Ajouter « pas d’éclairage artificiel, pas d’aspect de post-traitement numérique, pas de composition de banque d’images » oriente les résultats vers un réalisme éditorial.

Sujet par sujet

Des portraits qui trompent l’œil

Les portraits sont la catégorie la plus difficile. Les yeux humains sont calibrés par l’évolution pour détecter la moindre anomalie dans un visage : c’est le problème de la vallée de l’étrange. Pour le contourner avec GPT Image 1.5, l’approche consiste à ajouter des imperfections crédibles.

Les vrais visages présentent :

  • Un teint inégal : légèrement plus chaud sur le nez, plus froid sous les yeux
  • Une asymétrie : un œil légèrement plus haut, une narine plus large
  • Une texture adaptée au contexte : peau sèche en hiver, légère brillance par temps chaud
  • Des cheveux au comportement naturel : quelques mèches sur le front, un léger effet frisotté au sommet du crâne

Intégrez tout cela dans vos prompts. Le modèle le gère très bien lorsqu’on le lui demande. Sans cela, vous obtenez un visage qui paraît retouché par quelqu’un qui n’a jamais vu une vraie personne.

Portrait en gros plan extrême d’une jeune femme à la peau mate, regard hors champ avec une expression naturelle, pores et cils individuels nets

Paysages et architecture

Les paysages sont le domaine où GPT Image 1.5 a l’avantage naturel le plus net. Le modèle gère la perspective atmosphérique avec une précision remarquable : la façon dont les collines lointaines se fondent dans la brume, la manière dont le brouillard du matin reste bas au-dessus de l’eau.

Les règles à suivre ici :

  • Indiquez toujours un moment de la journée et une saison : ils contraignent précisément le comportement de la lumière
  • Ajoutez la météo : les journées couvertes donnent une belle lumière uniforme ; la pluie crée des surfaces réfléchissantes
  • Précisez les plans de profondeur : premier plan, sujet au second plan, arrière-plan lointain. Cela impose la profondeur
  • Incluez des textures à plusieurs échelles : du gravier sur un chemin, de la rouille sur une rambarde, de la mousse sur la pierre

Vue aérienne d’un village côtier méditerranéen à l’heure dorée, toits en terre cuite descendant vers une baie turquoise avec des bateaux de pêche

Produits et natures mortes

La photographie de produits est trompeusement exigeante. Le défi : les vraies photos de produits présentent une imperfection maîtrisée et intentionnelle : une empreinte digitale sur une bouteille, une légère ombre suggérant le poids, une surface qui a servi.

Pour une nature morte avec GPT Image 1.5 :

  • Utilisez des matériaux de surface nommés (marbre de Carrare, bois de noyer, lin gris), et non simplement « fond blanc »
  • Précisez le type d’ombre : « ombres longues et douces provenant d’une seule source placée au-dessus et légèrement à gauche »
  • Ajoutez des éléments organiques aux produits inorganiques (une branche d’herbe aromatique, une poignée de pétales) pour casser l’aspect clinique
  • Utilisez un vocabulaire de macro avec un 50 mm ou un 100 mm pour une texture de surface extrême

Vue en plongée élégante de produits de soin de luxe sur du marbre de Carrare vieilli, avec des ingrédients botaniques et une lumière de studio douce

Modèles de prompts à reprendre

La formule du portrait

[Subject with specific age, skin tone, hair type, natural imperfections] in [named location with specific time and season], wearing [specific fabric with texture description]. [Primary light: direction, quality, source]. [Secondary fill: brief description]. Caught in a [candid/contemplative/natural] moment. Shot on [camera body] with [lens] at [f-stop], ISO [number]. [Film stock] color grade, organic film grain, photorealistic, 8K. --ar 16:9 --style raw

La formule de l’environnement

[Aerial/low-angle/eye-level] view of [named location with cultural specificity] at [time of day] in [season/weather]. [Distance layer 1: specific texture]. [Distance layer 2: main subject]. [Distance layer 3: background quality and atmosphere]. [Light behavior at this time of day]. Shot at [focal length] f/[stop], [film stock] color grading, natural grain. --ar 16:9 --style raw

Femme élégante aux cheveux bouclés foncés à une table de café parisien en extérieur, lumière du matin accrochant la vapeur de l’expresso, immeubles haussmanniens en bokeh à l’arrière-plan

4 erreurs qui tuent le réalisme

1. Utiliser des adjectifs génériques : « magnifique », « époustouflant », « incroyable » ne disent rien au modèle sur la photographie. Remplacez-les par un vocabulaire d’observation précis.

2. Oublier l’arrière-plan : même lorsqu’il est flou, l’arrière-plan doit être physiquement crédible. « Arrière-plan flou » n’est pas un lieu. « Intérieur d’entrepôt flou avec des suspensions à lumière chaude » en est un.

3. Négliger le grain de film : les rendus IA numériquement propres ont l’air numériquement propres. Les vraies photos, même numériques et récentes, présentent du bruit, un micro-contraste et de subtiles variations de canaux couleur. Précisez toujours une pellicule ou un équivalent de bruit numérique.

4. Tout centrer : les photographes utilisent instinctivement la règle des tiers. Ajoutez du vocabulaire de composition : « sujet placé au tiers gauche du cadre », « regard tourné vers la moitié droite vide du cadre ». Cela casse le réflexe de symétrie de l’IA.

Femme sûre d’elle à la peau mate, en chemisier de soie bordeaux, debout près d’une fenêtre industrielle, lumière latérale dure sculptant ses traits

À vous de jouer : voyez ce que ça donne

L’écart entre une photo IA qui paraît générée et une image qui semble prise avec un Sony A1 tient presque entièrement à la précision du prompt. GPT Image 1.5 a les capacités. La question est de savoir si vos prompts lui donnent les informations dont il a besoin.

PicassoIA vous donne accès au modèle sans aucune configuration. Prenez la formule du portrait ci-dessus, remplacez le sujet par le vôtre et lancez-la. Comparez le résultat avec vos prompts précédents. La différence de texture, de comportement de la lumière et de réalisme de la composition sera immédiatement visible.

Au-delà de GPT Image 1.5, PicassoIA propose aussi des alternatives axées sur le photoréalisme, comme Flux 1.1 Pro Ultra, Realistic Vision v5.1 et Qwen Image 2, chacune avec ses atouts selon les catégories de sujets. La plateforme vous permet de passer de l’un à l’autre instantanément et de comparer les résultats côte à côte.

La photographie IA photoréaliste ne dépend plus d’avoir accès au bon modèle. Elle consiste à savoir comment demander ce que vous voulez.

Partager cet article

Choisissez votre langue