GPT Image 1.5 : comment créer des photos IA qui paraissent réelles
GPT Image 1.5 est ce que l’IA a produit de plus proche d’un vrai appareil photo. Cet article détaille les structures de prompt, le vocabulaire photographique, les termes d’éclairage et les approches propres à chaque sujet qui distinguent les images réalistes de celles qui ne le sont clairement pas.
GPT Image 1.5 ne donne pas la même impression que la plupart des modèles d’IA de génération d’images. Il ne génère pas le rendu. Il photographie. La différence est subtile jusqu’à ce que vous la voyiez, et ensuite vous ne pouvez plus l’ignorer : la façon dont la peau capte la lumière, la façon dont un arrière-plan flou donne encore l’impression d’un espace physique, la façon dont les objets ont du poids. Cet article explique comment réduire l’écart entre « clairement de l’IA » et « pourrait être une photo » avec GPT Image 1.5, et vous donne les cadres exacts pour y parvenir.
Ce qu’est vraiment GPT Image 1.5
Bien plus qu’un simple modèle de texte vers image
La plupart des générateurs d’images sont entraînés à produire des résultats esthétiques. GPT Image 1.5 est entraîné à produire des résultats fidèles. Il est issu du pipeline de recherche multimodale d’OpenAI, la même lignée qui a donné à GPT-4o sa capacité à raisonner sur des entrées visuelles. Ce contexte compte : le modèle a été exposé à la façon dont la photographie réelle fonctionne (distorsion de perspective, comportement des objectifs, décroissance de la profondeur, brume atmosphérique), et pas seulement à l’apparence des photos.
Le résultat est un modèle qui gère la logique photographique mieux que presque toutes les autres options disponibles. Demandez-lui un portrait à 85 mm et il comprimera subtilement l’arrière-plan comme le ferait réellement un 85 mm. Demandez une lumière du matin et il calculera où tombent les ombres sous cet angle. Ce n’est pas un comportement accidentel : c’est une compréhension apprise de la réalité physique.
En quoi il diffère des versions précédentes
Les anciens modèles d’image d’OpenAI excellaient dans l’illustration, le concept art et la narration visuelle. GPT Image 1.5 déplace nettement l’accent vers le photoréalisme et le respect des instructions. Là où DALL-E 3 pourrait interpréter « une femme qui lit près d’une fenêtre » avec une douceur picturale, GPT Image 1.5 la rend avec une précision documentaire : le grain du rebord en bois, le léger reflet dans la vitre, la façon dont ses cheveux tombent en trois dimensions.
Il gère aussi de manière plus réfléchie l’espace négatif et la composition. Le modèle semble comprendre que ce qui n’est pas dans le cadre compte autant que ce qui y est. C’est une intuition photographique dont manquent la plupart des autres modèles.
Pourquoi les photos IA paraissent encore fausses
Les 5 signes révélateurs
Même avec les meilleurs modèles, la plupart des images IA échouent au test du réel. Voici pourquoi :
Problème
À quoi ça ressemble
Pourquoi ça arrive
Peau trop lisse
Texture de plastique, aucun pore
Les modèles lissent les imperfections
Flou d’arrière-plan uniforme
Le flou de fond est parfaitement régulier
Aucune compréhension de l’optique des objectifs
Logique d’ombre incorrecte
Ombres issues d’angles impossibles
Modélisation incohérente de la source lumineuse
Reflets étranges dans les yeux
Reflets symétriques ou artificiels
Interpolés à partir de plusieurs sources
Composition trop parfaite
Centrée, statique, propre comme sur Instagram
Biais d’entraînement vers des images « jolies »
Ce que le modèle ne peut pas corriger seul
GPT Image 1.5 corrige automatiquement beaucoup de ces problèmes, en particulier la logique des ombres et le comportement des objectifs. Mais la texture de la peau, la variété des compositions et le grain sont des domaines où le prompt porte l’essentiel du travail. Le modèle n’ajoutera pas d’imperfections si vous ne le lui demandez pas. Il ne photographiera pas depuis un angle bas si vous n’en précisez pas un. Il n’ajoutera pas de grain argentique si vous ne nommez pas la pellicule. Vous devez parler sa langue.
💡 L’idée essentielle : les vraies photos sont imparfaites. Vos prompts doivent demander explicitement cette imperfection. Si votre prompt sonne comme un texte publicitaire, le résultat ressemblera à une photo de banque d’images.
Construire un prompt photoréaliste
La formule de base du prompt
La meilleure amélioration que vous puissiez apporter à vos prompts consiste à ajouter quatre couches de précision : le sujet, l’environnement, la lumière et la caméra. La plupart des gens soignent le sujet et négligent les trois autres.
[Subject with natural imperfection] + [Specific environment with texture details] + [Named light source, direction, and quality] + [Camera model, lens, f-stop, ISO] + [Film stock or color grade] + [--ar 16:9 --style raw]
Voici un avant et un après :
Faible : Une femme assise près d’une fenêtre
Fort : Une femme de fin vingtaine, avec des taches de rousseur naturelles et des cheveux légèrement ébouriffés par le vent, assise à côté d’une baie vitrée du sol au plafond dans un appartement minimaliste de Tokyo à 4PM, par un jour couvert, une lumière grise diffuse éclairant la scène par la gauche sans ombres marquées, prise avec un Sony A7IV et un objectif 85mm f/1.8, gradation colorimétrique Kodak Portra 400, grain de pellicule visible, --ar 16:9 --style raw
Le second prompt ne laisse aucune place au modèle pour retomber sur quelque chose de générique.
Le langage de la caméra et des objectifs qui fonctionne
C’est l’outil le moins exploité de l’ingénierie de prompt pour le photoréalisme. Des objectifs différents produisent des images fondamentalement différentes, et GPT Image 1.5 comprend ces différences.
Objectif
Effet
Idéal pour
24 mm f/2.8
Grand angle, légère distorsion sur les bords
Architecture, intérieurs, environnement
50 mm f/1.8
Perspective naturelle, compression plate
Rue, documentaire, portraits décontractés
85 mm f/1.4
Arrière-plan compressé, beau bokeh
Portraits intimes, gros plans
135 mm f/2.0
Forte compression, faible profondeur de champ
Portraits centrés sur le détail, sujets éloignés
Associez toujours l’objectif à un vrai boîtier d’appareil photo : Sony A7IV, Nikon Z8, Canon R5, Leica M11. Cela ancre le modèle dans les conventions de la photographie professionnelle plutôt que dans des esthétiques « photo » génériques.
Le vocabulaire de l’éclairage qui change tout
« Une belle lumière » est la formule la plus inutile de l’ingénierie de prompt. Un vocabulaire d’éclairage précis produit des résultats précis, qui paraissent réels.
Utilisez ce vocabulaire :
Direction : depuis le haut à gauche, depuis directement derrière, depuis un angle bas à 30 degrés
Qualité : soleil direct et dur, diffusion douce de ciel couvert, lueur chaude de lampes à incandescence en intérieur, rayons volumétriques de l’heure dorée
Interaction avec le sujet : créant un halo naturel à travers les cheveux, projetant des ombres en relief sur les pommettes, remplissant la scène d’un rebond ambiant depuis un mur blanc
Température de couleur : lumière du jour à 5500 K, chaleur de bougie à 2800 K, la qualité bleu-gris d’un matin d’hiver
💡 Astuce pro : combinez une source de lumière principale avec un remplissage secondaire, exactement comme le ferait un vrai photographe. Exemple : « Lumière principale : soleil d’après-midi dur venant de la droite, créant des ombres marquées. Remplissage : rebond ambiant doux depuis un sol en béton clair. »
Utiliser GPT Image 1.5 sur PicassoIA
GPT Image 1.5 est disponible directement sur PicassoIA, où vous pouvez l’utiliser sans accès API, sans configuration de facturation ni environnement de développement. Voici comment tirer le meilleur parti du modèle sur la plateforme.
Rédigez votre prompt en suivant la formule ci-dessus : sujet + environnement + lumière + caméra
Réglez le format sur 16:9 pour les scènes cinématographiques, 4:5 pour les portraits, 1:1 pour les photos de produits
Ajoutez des modificateurs de style à la fin : --style raw signale le photoréalisme plutôt que l’illustration
Lancez et évaluez : cherchez les signes révélateurs de l’IA listés plus haut. Si vous voyez une peau uniforme, relancez avec un vocabulaire de texture explicite
Réglages et paramètres à essayer
Quelques combinaisons qui donnent régulièrement de bons résultats :
Portraits : vocabulaire 85 mm + lumière de fenêtre + Kodak Portra 400 + pores ou taches de rousseur visibles
Environnements : grand angle + lieu nommé + météo ou moment de la journée précis + grain de film
Produits : macro en plongée + surface nommée en marbre ou en bois + lumière de studio douce venant du haut
💡 Le modèle respecte bien les descriptions négatives. Ajouter « pas d’éclairage artificiel, pas d’aspect de post-traitement numérique, pas de composition de banque d’images » oriente les résultats vers un réalisme éditorial.
Sujet par sujet
Des portraits qui trompent l’œil
Les portraits sont la catégorie la plus difficile. Les yeux humains sont calibrés par l’évolution pour détecter la moindre anomalie dans un visage : c’est le problème de la vallée de l’étrange. Pour le contourner avec GPT Image 1.5, l’approche consiste à ajouter des imperfections crédibles.
Les vrais visages présentent :
Un teint inégal : légèrement plus chaud sur le nez, plus froid sous les yeux
Une asymétrie : un œil légèrement plus haut, une narine plus large
Une texture adaptée au contexte : peau sèche en hiver, légère brillance par temps chaud
Des cheveux au comportement naturel : quelques mèches sur le front, un léger effet frisotté au sommet du crâne
Intégrez tout cela dans vos prompts. Le modèle le gère très bien lorsqu’on le lui demande. Sans cela, vous obtenez un visage qui paraît retouché par quelqu’un qui n’a jamais vu une vraie personne.
Paysages et architecture
Les paysages sont le domaine où GPT Image 1.5 a l’avantage naturel le plus net. Le modèle gère la perspective atmosphérique avec une précision remarquable : la façon dont les collines lointaines se fondent dans la brume, la manière dont le brouillard du matin reste bas au-dessus de l’eau.
Les règles à suivre ici :
Indiquez toujours un moment de la journée et une saison : ils contraignent précisément le comportement de la lumière
Ajoutez la météo : les journées couvertes donnent une belle lumière uniforme ; la pluie crée des surfaces réfléchissantes
Précisez les plans de profondeur : premier plan, sujet au second plan, arrière-plan lointain. Cela impose la profondeur
Incluez des textures à plusieurs échelles : du gravier sur un chemin, de la rouille sur une rambarde, de la mousse sur la pierre
Produits et natures mortes
La photographie de produits est trompeusement exigeante. Le défi : les vraies photos de produits présentent une imperfection maîtrisée et intentionnelle : une empreinte digitale sur une bouteille, une légère ombre suggérant le poids, une surface qui a servi.
Pour une nature morte avec GPT Image 1.5 :
Utilisez des matériaux de surface nommés (marbre de Carrare, bois de noyer, lin gris), et non simplement « fond blanc »
Précisez le type d’ombre : « ombres longues et douces provenant d’une seule source placée au-dessus et légèrement à gauche »
Ajoutez des éléments organiques aux produits inorganiques (une branche d’herbe aromatique, une poignée de pétales) pour casser l’aspect clinique
Utilisez un vocabulaire de macro avec un 50 mm ou un 100 mm pour une texture de surface extrême
Modèles de prompts à reprendre
La formule du portrait
[Subject with specific age, skin tone, hair type, natural imperfections] in [named location with specific time and season], wearing [specific fabric with texture description]. [Primary light: direction, quality, source]. [Secondary fill: brief description]. Caught in a [candid/contemplative/natural] moment. Shot on [camera body] with [lens] at [f-stop], ISO [number]. [Film stock] color grade, organic film grain, photorealistic, 8K. --ar 16:9 --style raw
La formule de l’environnement
[Aerial/low-angle/eye-level] view of [named location with cultural specificity] at [time of day] in [season/weather]. [Distance layer 1: specific texture]. [Distance layer 2: main subject]. [Distance layer 3: background quality and atmosphere]. [Light behavior at this time of day]. Shot at [focal length] f/[stop], [film stock] color grading, natural grain. --ar 16:9 --style raw
4 erreurs qui tuent le réalisme
1. Utiliser des adjectifs génériques : « magnifique », « époustouflant », « incroyable » ne disent rien au modèle sur la photographie. Remplacez-les par un vocabulaire d’observation précis.
2. Oublier l’arrière-plan : même lorsqu’il est flou, l’arrière-plan doit être physiquement crédible. « Arrière-plan flou » n’est pas un lieu. « Intérieur d’entrepôt flou avec des suspensions à lumière chaude » en est un.
3. Négliger le grain de film : les rendus IA numériquement propres ont l’air numériquement propres. Les vraies photos, même numériques et récentes, présentent du bruit, un micro-contraste et de subtiles variations de canaux couleur. Précisez toujours une pellicule ou un équivalent de bruit numérique.
4. Tout centrer : les photographes utilisent instinctivement la règle des tiers. Ajoutez du vocabulaire de composition : « sujet placé au tiers gauche du cadre », « regard tourné vers la moitié droite vide du cadre ». Cela casse le réflexe de symétrie de l’IA.
À vous de jouer : voyez ce que ça donne
L’écart entre une photo IA qui paraît générée et une image qui semble prise avec un Sony A1 tient presque entièrement à la précision du prompt. GPT Image 1.5 a les capacités. La question est de savoir si vos prompts lui donnent les informations dont il a besoin.
PicassoIA vous donne accès au modèle sans aucune configuration. Prenez la formule du portrait ci-dessus, remplacez le sujet par le vôtre et lancez-la. Comparez le résultat avec vos prompts précédents. La différence de texture, de comportement de la lumière et de réalisme de la composition sera immédiatement visible.
Au-delà de GPT Image 1.5, PicassoIA propose aussi des alternatives axées sur le photoréalisme, comme Flux 1.1 Pro Ultra, Realistic Vision v5.1 et Qwen Image 2, chacune avec ses atouts selon les catégories de sujets. La plateforme vous permet de passer de l’un à l’autre instantanément et de comparer les résultats côte à côte.
La photographie IA photoréaliste ne dépend plus d’avoir accès au bon modèle. Elle consiste à savoir comment demander ce que vous voulez.