Vous souvenez-vous de l’époque où les générateurs d’images IA étaient incapables de conserver le même visage à un personnage entre deux images ? Eh bien, Google vient de lancer son nouveau modèle très attendu (nom de code : nano-banana 🍌), désormais connu sous le nom de Gemini 2,5 Flash Image, que vous pouvez essayer gratuitement sur AI Studio.
Le plus impressionnant ? Ce modèle assure une cohérence des personnages comme rien de ce que nous avons vu jusqu’ici. Vous pouvez placer le même personnage dans un désert, puis sous l’eau, puis en discothèque — et il aura vraiment l’air d’être la même personne. C’est dingue.
Voici ce qui s’est passé lorsque nous avons essayé d’utiliser ChatGPT Image pour retoucher mon visage sur les miniatures YouTube du podcast The Neuron :

Même si vous n’avez jamais regardé notre podcast, vous pouvez probablement voir que ce n’est absolument pas à ça que Grant ressemble… ils ne sont même pas cohérents entre eux ! Même si, pour être honnête, le premier gars est plutôt mignon.
Ce qui rend nano-banana si spécial
- Une cohérence des personnages qui fonctionne vraiment : Google a conçu une application modèle qui montre comment conserver des personnages identiques d’une scène à l’autre.
- Modifiez des photos ou des dessins avec de simples mots : la démo de retouche photo vous permet de supprimer des personnes, de flouter les arrière-plans ou de coloriser des photos en langage naturel… et cette démo de dessin collaboratif vous permet de dessiner et de demander à l’IA de corriger votre création.
- Une véritable connaissance du monde : contrairement aux autres modèles d’image, celui-ci sait des choses — notamment comment la démo de dessin collaboratif transforme des gribouillages en expériences d’apprentissage.
- Fusion de plusieurs images : vous pouvez désormais fusionner plusieurs images ; par exemple, vous pouvez faire glisser-déposer des objets d’une image à l’autre en toute fluidité grâce à son modèle de canevas d’accueil.
À 0,039 dollar US par image (arrondissez simplement à 0,04 dollar US par image, ou 40 dollars US pour 1 000 images, lol), c’est étonnamment abordable pour ce que vous obtenez.
La vitesse à laquelle tout cela se répand est folle
OpenRouter vient de l’ajouter comme son tout premier modèle d’image (sur plus de 480 modèles !), fal.ai l’apporte à sa communauté de développeurs, et Adobe vient de l’intégrer à Firefly.
Eh oui — Adobe propose désormais à la fois ses propres modèles Firefly et Gemini de Google, ainsi que des modèles d’OpenAI, de Black Forest Labs (qui fabrique FLUX), de Runway, Pika, Ideogram, LumaAI et d’autres encore. On dirait que les guerres des modèles d’IA viennent de se transformer en traité de paix des modèles d’IA.
Pourquoi c’est important
Nous assistons au passage de « mon modèle est meilleur que le tien » à « voici un buffet de modèles — choisissez celui qui fonctionne ». Adobe l’a bien compris. Plutôt que de contraindre les créateurs à rester dans un seul écosystème, l’entreprise devient la Suisse de la créativité IA.
Nous ne savons pas si cela a quelque chose à voir avec le fait que les grands laboratoires jettent l’éponge concernant leur marketing de l’IA fondé sur l’idée d’un « modèle unique pour les gouverner tous », obsédé par le passage à l’échelle et par une AGI à tout prix, ou s’ils se résignent simplement à l’idée que les gens veulent le meilleur modèle adapté à leurs besoins, mais c’est une évolution intéressante.
Quoi qu’il en soit, il devient de plus en plus évident que l’avenir de l’IA ne repose pas sur un modèle géant unique pour tous les gouverner — il s’agit plutôt de disposer du bon outil pour chaque tâche particulière.
Note de la rédaction : Ce contenu a d’abord été publié dans notre publication sœur, The Neuron. Pour découvrir davantage de contenus de The Neuron, inscrivez-vous à sa newsletter ici.

