Prompt pour modifier une photo avec ChatGPT
Modifier une photo avec ChatGPT ne se limite pas à “recréer” une image à partir de zéro. L’outil permet aussi d’éditer une photo existante, de corriger une zone précise ou de transformer l’ensemble du visuel à partir d’instructions en texte. Bien utilisé, ce fonctionnement donne un vrai contrôle sur le rendu, à condition de formuler une demande claire et structurée.
Pour les pressés :
Éditez une photo rapidement et de façon prévisible en combinant une sélection ciblée, un prompt structuré et des retouches par étapes.
- Vérifiez le format et la taille : utilisez png, webp ou jpg, de préférence moins de 50 MB pour les modèles image GPT, ou un png carré de moins de 4 MB pour dall-e-2.
- Je vous conseille de procéder en ciblant la zone avec l’outil Select ou en la décrivant précisément dans le prompt, puis d’appliquer les retouches par petites étapes.
- Rédigez un prompt structuré en 1 à 3 phrases : contexte source, changement exact, éléments à préserver, style et contrainte de sortie.
- Ajoutez une consigne négative, par exemple ne pas modifier le visage, pour limiter les interprétations indésirables.
- Vérifiez les limites du modèle (formats, taille, nombre d’images) et comparez plusieurs variantes en utilisant les commandes annuler et rétablir pour choisir la version la plus cohérente.
Comprendre la modification de photo avec ChatGPT
ChatGPT Images fonctionne selon deux logiques complémentaires, la génération d’une nouvelle image et l’édition d’une image déjà importée. Dans le premier cas, vous décrivez ce que vous voulez obtenir. Dans le second, vous chargez une photo existante, puis vous demandez une transformation, une retouche ou une suppression d’élément.
Si vous cherchez des alternatives à ChatGPT pour l’édition d’images, consultez notre article sur les meilleurs sites comme ChatGPT.
L’édition peut concerner toute l’image ou seulement une partie. Vous pouvez soit écrire directement dans le prompt que la modification doit s’appliquer à une zone précise, soit utiliser l’outil de sélection pour cadrer la retouche. Cette approche est utile pour un arrière-plan, un visage, un objet ou un détail de composition.
Les formats acceptés dépendent du modèle. Pour ChatGPT Images et les modèles image GPT, les fichiers doivent être en png, webp ou jpg, avec une taille inférieure à 50 MB par image. Pour dall-e-2, la contrainte est plus stricte, avec un png carré de moins de 4 MB.
Autre différence importante, les modèles image GPT autorisent l’édition de jusqu’à 16 images simultanément. La longueur du texte de consigne est aussi plus souple, avec une limite de 32 000 caractères pour image GPT, contre 1 000 caractères pour dall-e-2. Dans la plupart des cas, toutefois, un prompt court suffit si les instructions sont bien construites.
Comment formuler et structurer un prompt pour modifier une photo
Un prompt efficace pour retoucher une photo dans ChatGPT repose sur une formulation directe. L’idée est de donner assez de contexte pour guider le modèle, sans noyer la demande sous des détails inutiles. OpenAI recommande souvent un texte de 1 à 3 phrases, à condition qu’elles soient précises.
Pour se former aux outils d’édition assistée par IA, la formation Runway constitue une option pertinente.
Pour obtenir un résultat cohérent, il faut couvrir cinq éléments. D’abord, le contexte source, c’est-à-dire le type d’image ou la scène de départ. Ensuite, le changement exact à appliquer. Puis, les zones à préserver, le style visuel souhaité, et enfin une contrainte de sortie qui limite les erreurs ou les ajouts indésirables.
Une bonne structure de prompt ressemble souvent à ceci : “Sur ce portrait en extérieur, change la couleur des cheveux en châtain clair, garde le visage intact, applique un rendu naturel et lumineux, ne modifie pas l’arrière-plan”. Ici, chaque partie joue un rôle précis et réduit les interprétations ambiguës.
Pour un portrait, vous pouvez demander une amélioration de netteté, une correction légère de la peau ou une variation de couleur. Pour un décor, vous pouvez demander la suppression d’un élément perturbateur ou le remplacement du fond. Pour un rendu plus créatif, vous pouvez viser une transformation en illustration, en aquarelle ou en style cinématographique.
Il est utile d’ajouter une consigne négative. Par exemple, “ne pas modifier le visage”, “ne pas changer la posture” ou “ne pas toucher à la lumière principale”. Ce type de précision aide à conserver ce qui fonctionne déjà dans l’image d’origine.
Voici quelques exemples de formulations adaptées à des cas courants.
- Retouche de portrait : “À partir de ce portrait, éclaircis légèrement le teint, rends les cheveux plus foncés et améliore la netteté du visage sans changer l’expression.”
- Suppression d’arrière-plan : “Supprime l’arrière-plan et remplace-le par un fond neutre gris clair, en conservant le sujet principal parfaitement découpé.”
- Transformation artistique : “Transforme cette photo en illustration aquarelle, avec des contours doux et des couleurs pastel, tout en gardant la composition originale.”
- Style professionnel : “Convertis cette image en photo de profil professionnelle, avec éclairage studio, fond sobre et rendu réaliste.”
Plus votre demande est ciblée, plus le modèle comprend la priorité de retouche. À l’inverse, un prompt trop générique du type “améliore cette photo” laisse trop de marge d’interprétation et produit souvent un résultat imprévisible.

Étapes pour modifier une photo dans ChatGPT : mode d’emploi
La modification d’une image existante suit une logique simple. Vous commencez par importer la photo dans ChatGPT, ou par sélectionner une image déjà générée. Ensuite, vous précisez ce que vous voulez changer, soit dans le champ de conversation, soit en ciblant une zone avec l’outil de sélection.
Si la retouche doit se limiter à une partie de l’image, l’outil Select est le plus efficace. Vous dessinez la zone concernée, puis vous ajustez sa taille si nécessaire. Sur mobile, le curseur de sélection permet d’affiner la zone avec davantage de précision, ce qui est utile pour un visage, un objet ou un détail de fond.
Une fois la sélection faite, vous rédigez le prompt. C’est à ce moment qu’il faut insister sur la nature exacte du changement et sur les éléments à conserver. L’interface permet ensuite de tester la proposition puis de gérer les variations avec les commandes Undo, Redo, Cancel et Save.
Cette façon de travailler est plus fiable lorsqu’on procède par petites étapes. Au lieu de demander une transformation complète en une seule fois, il vaut mieux faire une modification, contrôler le rendu, puis passer à la suivante. Cette méthode limite les dérives sur la composition, les proportions ou les détails du visage.
Les différences entre modèles comptent aussi dans la préparation du fichier. Avec les modèles image GPT, vous pouvez travailler avec plusieurs images, jusqu’à 16, à condition qu’elles soient en png, webp ou jpg et sous la barre des 50 MB. Avec dall-e-2, le cadre est plus limité, avec un png carré de moins de 4 MB et un texte de consigne plus court.
Pour améliorer le résultat, il est souvent utile de fournir une photo de référence quand il s’agit d’un portrait. Vous pouvez aussi enrichir la consigne avec des indications sur le cadrage, l’éclairage, les couleurs dominantes ou les matériaux visibles. Ces détails aident le modèle à rester cohérent avec l’intention de départ.
Si vous préférez maîtriser des logiciels de retouche plus classiques, la formation Filmora propose un guide pratique.
Le tableau ci-dessous résume les principales limites techniques selon le modèle utilisé.
| Modèle | Formats acceptés | Taille maximale | Nombre d’images | Longueur du prompt |
|---|---|---|---|---|
| ChatGPT Images / modèles image GPT | png, webp, jpg | Moins de 50 MB par image | Jusqu’à 16 images | Jusqu’à 32 000 caractères |
| dall-e-2 | png carré | Moins de 4 MB | 1 image | Jusqu’à 1 000 caractères |
Bonnes pratiques, cas d’utilisation et erreurs fréquentes à éviter
Les usages les plus fréquents de la modification de photo avec ChatGPT sont assez faciles à identifier. On retrouve la suppression d’éléments d’arrière-plan, la retouche esthétique de portraits, l’application de styles artistiques et la création de photos de profil plus professionnelles. Dans tous ces cas, le point commun reste la même logique, une consigne claire et une zone bien définie.
Pour les portraits, les modifications demandées concernent souvent la tonalité de peau, la couleur des cheveux, la netteté ou un léger changement de style. Pour les images de marque ou de présentation, la priorité est plutôt la cohérence visuelle, avec un fond propre, une lumière lisible et un rendu crédible. Le bon arbitrage consiste à ne modifier qu’un seul paramètre à la fois.
Cette approche par étapes évite les effets secondaires. Si vous changez simultanément le fond, le style, la lumière et la posture, le modèle peut perdre la structure initiale de l’image. En travaillant de façon plus ciblée, vous gardez le contrôle sur la composition finale et vous obtenez des résultats plus stables.
Les erreurs les plus courantes viennent souvent de prompts trop vagues. Une demande comme “rends l’image meilleure” ne donne ni direction technique ni cadre de rendu. Il vaut mieux préciser l’intention, la zone concernée, ce qui doit rester inchangé et le style attendu. La formulation directe est presque toujours plus productive qu’une instruction générale.
Il faut aussi respecter les limites du modèle choisi. Un fichier trop lourd, un format non compatible ou un nombre d’images supérieur à la limite peut bloquer la demande ou dégrader le flux de travail. Vérifier ces contraintes avant l’envoi fait gagner du temps et évite des allers-retours inutiles.
Enfin, quand le résultat semble hésitant, demander plusieurs variantes reste une bonne méthode de sélection. Vous comparez alors les versions, vous retenez la plus cohérente, puis vous affinez si besoin. Pour la retouche photo dans ChatGPT, la qualité vient souvent moins d’une seule commande ambitieuse que d’une suite de petits ajustements bien formulés.
En résumé, plus votre prompt est structuré, plus la modification de photo avec ChatGPT devient prévisible et exploitable.