OpenAI entend éclipser le Nano Banana de Google avec le lancement d’un ChatGPT Images entièrement repensé, dernière évolution de son générateur d’images IA, conçu pour positionner la plateforme d’IA générative comme un véritable studio créatif.
Déployée mardi, la mise à jour réunit génération et retouche d’images au sein d’un même flux conversationnel. Les utilisateurs peuvent ainsi créer des images à partir de texte, modifier des visuels importés et affiner les résultats grâce à des instructions en langage naturel, sans devoir relancer les prompts. OpenAI affirme que cette refonte permet une génération plus rapide, des itérations plus fluides et une meilleure adéquation avec les intentions de l’utilisateur.
Plutôt que de fonctionner comme un générateur produisant une seule image, ChatGPT Images se présente comme un espace de travail multimodal qui conserve le contexte visuel au fil des itérations, ce qui facilite l’ajustement de la composition, du style et des différents éléments à mesure que les idées évoluent.
Fidji Simo, directrice générale des Applications chez OpenAI, a indiqué dans sa dernière publication sur Substack que cette mise à jour s’inscrit dans une évolution plus large vers des expériences d’IA dynamiques, où les utilisateurs n’ont pas à changer d’outil ou de mode pour créer, le modèle s’adaptant en continu à mesure que le prompt évolue.
« Nous avons lancé aujourd’hui un nouveau modèle de génération d’images et un point d’accès dédié aux images dans ChatGPT, qui fonctionne davantage comme un studio créatif », a écrit Simo. « Les nouveaux écrans de visualisation et de retouche facilitent la création d’images conformes à votre vision ou l’exploration d’idées à partir de prompts tendance et de filtres prédéfinis. »
Simo a ajouté que les améliorations d’Images concernent aussi des éléments clés comme la composition, l’éclairage et la cohérence des ressemblances d’une itération à l’autre, afin que les résultats restent plus proches des intentions de l’utilisateur.
Une rivalité historique
OpenAI déploie Images à grande échelle dans ChatGPT, en intégrant la génération et la retouche d’images à l’expérience centrale plutôt qu’en les traitant comme un outil distinct — une refonte qui le rapproche du Nano Banana de Google en matière de cohérence de l’expérience et qui, dans certains cas, le dépasse en rendant l’itération sur les images conversationnelle plutôt que dépendante d’une réinitialisation du prompt.
OpenAI s’est retrouvé plus d’une fois en position de challenger ces derniers mois, alors que l’accueil enthousiaste réservé aux dernières mises à jour de Gemini par Google et la sortie de Nano Banana ont relevé les attentes en matière de vitesse, d’ergonomie et de fidélité visuelle. Cette réaction a accru la pression exercée sur OpenAI pour faire évoluer plus agressivement les capacités créatives de ChatGPT, plutôt que de considérer la génération d’images comme une fonctionnalité secondaire.
Cette rivalité a accéléré le cycle des lancements et des réactions, Google comme OpenAI orientant leurs plateformes d’IA générative vers des écosystèmes créatifs plus vastes. Dans ce contexte, les outils conçus pour l’idéation, l’explication et la narration doivent de plus en plus fonctionner comme des espaces créatifs unifiés, à l’image du rôle traditionnellement joué par des suites comme Adobe et Affinity.
Une bataille créative dans la course à l’IA
L’amélioration de la qualité d’OpenAI Images et le succès de Nano Banana de Google témoignent d’une volonté commune de retenir l’attention des utilisateurs au sein de la plateforme, en transformant la génération d’images en une boucle créative et de raisonnement continue plutôt qu’en une tâche produisant un résultat unique.
À mesure que les plateformes d’IA générative prennent en charge une part croissante des étapes d’exploration et d’itération du travail visuel, les outils créatifs établis comme Adobe et Affinity risquent de subir une pression non pas sur la qualité des résultats, mais sur le lieu et le moment où les utilisateurs choisissent de les utiliser.
Dans la course plus large à l’IA, la dynamique dépend de plus en plus de la capacité des plateformes à maintenir le flux créatif dans la durée, ce qui laisse penser que le contrôle de l’environnement créatif, plutôt que des avancées techniques isolées, pourrait constituer l’avantage le plus durable.
Pour en savoir plus sur le générateur d’images Nano Banana de Google, consultez l’article d’eWeek consacré à Nano Banana 2 Flash.


