Mode test Stripe — aucun paiement réel n’est encaissé. Remplacez les clés par celles de votre compte de production avant l’ouverture.
Livraison instantanée après paiement Conforme EU AI Act — métadonnées de provenance incluses Mises à jour à vie sur tous les packs Édition 2026 — tarif de lancement Livraison instantanée après paiement Conforme EU AI Act — métadonnées de provenance incluses Mises à jour à vie sur tous les packs Édition 2026 — tarif de lancement
Boutique Collections La méthode Journal Contact
Le catalogue complet Commencer à 4,99 €

Technique · 11 min de lecture

Prompt engineering photo-réaliste : les 12 paramètres qui font la différence

Pourquoi vos images ressemblent à des rendus de jeu vidéo, et comment y remédier. Les contraintes techniques exactes qui font basculer une génération IA du côté du crédible.

Publié le · Mis à jour le

Le problème n’est presque jamais le modèle. Les générateurs actuels sont capables d’un photo-réalisme indiscernable. Le problème, c’est que sans contrainte, ils dérivent tous vers le même défaut : une image trop propre, trop composée, trop éclairée. Le fameux « rendu jeu vidéo ».

Voici les douze paramètres qui corrigent cette dérive. Ils sont classés par impact décroissant.

1. Le vocabulaire d’appareil

Écrire shot on iPhone 17 Pro, unedited produit un résultat radicalement différent de professional photography. Le second convoque tout l’imaginaire du studio : éclairage tri-points, retouche, pose. Le premier convoque le candide, le bruit de capteur, la légère surexposition du ciel. Pour du contenu lifestyle crédible, c’est le second registre qu’il faut.

2. Le paramètre de style brut

Sur Midjourney, --style raw désactive l’embellissement esthétique par défaut. Sans lui, le modèle ajoute systématiquement du contraste, de la saturation et une composition « jolie ». Avec lui, vous récupérez la main. C’est le paramètre le plus sous-utilisé du logiciel.

3. L’anglais, sans exception

Tous les prompts sérieux s’écrivent en anglais. Ce n’est pas du snobisme : le vocabulaire visuel des modèles est entraîné majoritairement sur des corpus anglophones. « Lumière rasante de fin d’après-midi » donne un résultat approximatif ; low raking afternoon light donne exactement l’effet demandé.

4. La localisation chirurgicale

C’est le paramètre qui sépare un contenu français crédible d’une imitation américaine. Sans précision géographique, un modèle génère par défaut une rue américaine, un trottoir en béton, un ciel de Californie. Les contraintes qui corrigent : French white licence plate in AB-123-CD format with blue EU band, Haussmannian wrought-iron balcony, Paris overcast sky, zinc rooftops, green cast-iron street lamp.

Un créateur français qui publie des visuels au décor américain perd immédiatement la moitié de sa crédibilité auprès de son audience locale. C’est la première chose que les commentaires relèvent.

5. Le point de vue subjectif

Le format POV — POV, looking down at hands holding a leather steering wheel — génère l’illusion que le spectateur est à la place du créateur. C’est ce qui produit les meilleurs taux de rétention sur les formats verticaux, parce que le cerveau traite l’image comme une expérience plutôt que comme une observation.

6. La direction lumière explicite

Ne dites pas « bien éclairé ». Dites d’où vient la lumière, combien il y a de sources, et laquelle domine. single warm source from camera left, deep falloff to the right, no fill produit du clair-obscur. Sans cette précision, le modèle applique un éclairage uniforme et plat qui trahit la génération.

7. La profondeur de champ et la focale

Une focale implicite modifie toute la géométrie de l’image. 85mm, f/1.8 compresse les plans et isole le sujet. 24mm, f/8 ouvre l’espace et garde tout net. Beaucoup d’images IA échouent parce qu’elles mélangent les deux : un arrière-plan flou avec une perspective grand-angle, une combinaison optiquement impossible que l’œil détecte sans savoir pourquoi.

8. Le mouvement directionnel

Le flou de mouvement est la difficulté numéro un. Les modèles l’appliquent uniformément, ce qui donne une image simplement floue. Il faut séparer explicitement le sujet du fond : subject sharp, horizontal motion blur on background only, panning shot. C’est ce qui produit un filé crédible en photographie sportive ou automobile.

9. Les imperfections volontaires

Une image parfaite est une image fausse. Les contraintes qui réintroduisent du réel : slight lens flare, dust on the windshield, skin texture with visible pores, fingerprint smudge on glass, slightly crooked horizon. Chacune paraît anodine ; ensemble, elles font basculer la perception.

10. La cohérence des réflexions

Le chrome, l’eau mouillée, le verre et la peinture brillante ne sont pas des matières : ce sont des miroirs. Un prompt qui dit « chrome brillant » produit une bouillie argentée. Un prompt qui dit chrome reflecting a sunset sky and the yellow line of the road produit un chrome crédible, parce qu’il décrit ce qui est reflété.

11. Le contrôle du texte

Les modèles génèrent toujours mal le texte fin. Deux stratégies : l’éviter par le cadrage (macro partielle sur un cadran plutôt que cadran entier), ou l’assumer flouté (out-of-focus signage in background). Ne jamais laisser un texte net et petit dans le champ.

12. Le ratio déclaré dès l’écriture

Un prompt écrit pour du 16:9 ne fonctionne pas en 9:16. La composition, le point de fuite et la place du sujet changent. Il faut écrire deux prompts distincts, pas ajouter un ratio à la fin d’un prompt paysage. C’est pour cette raison que nos packs sont intégralement écrits en vertical 9:16, le format des Reels et de TikTok, et que le ratio figure dans le corps même de chaque prompt.

Un exemple, avant et après

Avant : luxury car in Monaco at night, beautiful, high quality, 4k. Résultat : une voiture indéfinissable, un décor générique, un éclairage de vitrine.

Après : POV from sidewalk, black hypercar parked outside Monte-Carlo casino at 11pm, wet asphalt reflecting warm architectural lighting, single source from the left, 35mm f/2.0, shot on iPhone 17 Pro, unedited, slight sensor noise in shadows, French plate visible, --style raw --ar 9:16.

Même modèle, même seconde de calcul. La différence tient entièrement dans la contrainte.

Combien de temps pour écrire un prompt de ce niveau

Entre vingt minutes et deux heures, selon la difficulté de la matière. Pour un pack de quatre-vingts prompts, cela représente plusieurs semaines de travail à temps plein — et c’est précisément ce que vous achetez quand vous prenez un pack thématique plutôt que de partir de zéro.

Les packs cités

Paris Haussmann — exemple d’image générée avec le pack
Le plus polyvalent
−67% 25 prompts

France · Pack signature

Paris Haussmann

25 prompts sur le Paris réel : haussmannien, brasserie, nuit, banlieue, musées. Sans Tour Eiffel ni béret.

8 chapitres

9,99 € 29,99 €

Côte d’Azur — exemple d’image générée avec le pack
Best-seller
−67% 25 prompts

France · Pack signature

Côte d’Azur

25 prompts écrits à la main sur Monaco, Cannes, Saint-Tropez, les corniches et le Cap d’Antibes. La Riviera réelle, pas la carte postale générique.

8 chapitres

9,99 € 29,99 €

Collection France — exemple d’image générée avec le pack
Collection
−40% 227 prompts

France · Collection

Collection France

Les cinq packs français réunis : Côte d’Azur, Paris, Corse, Courchevel, Domaines & Vignobles.

5 packs inclus

29,99 € 49,95 €

Offert — aucune carte demandée

3 prompts offerts

Trois prompts complets, non bridés, extraits des packs. Vous jugez le niveau d’écriture sur pièces, puis vous décidez.

  • Trois prompts complets, avec leur bloc d’identité intact
  • Le mode d’emploi : quoi téléverser, et quand régénérer
  • Un code de réduction sur votre premier pack

Aucune carte bancaire demandée. Vos données ne sont ni vendues ni cédées — voir la politique de confidentialité.

À lire ensuite

Dans le même dossier.