Google $GOOGL est devenu fou — Nano Banana, c'est-à-dire. Maintenant, OpenAI a fait son entrée dans le chat. Mardi, la société a déployé une expérience ChatGPT Images remaniée alimentée par GPT Image 1.5 ; la nouvelle interface atteindra la plupart des utilisateurs immédiatement — bien que les utilisateurs Business et Enterprise l'obtiendront plus tard.
La société affirme que le modèle est jusqu'à quatre fois plus rapide et est également disponible via l'API sous le nom de GPT-Image-1.5. Et la section ChatGPT Images repensée ajoute un onglet Images dédié dans la barre latérale et s'appuie sur des filtres prédéfinis et des suggestions d'invite, peut-être une manière moins évidente de dire qu'OpenAI veut que les formats viraux vivent sur son terrain.
Dans une vidéo de présentation, OpenAI a montré des comparaisons côte à côte pour mettre en évidence les gains de fidélité, y compris une scène de Chelsea, Londres, des années 1970 et un mécanicien travaillant sur une voiture. Et cela pourrait être un indice sur ce que OpenAI pense être le véritable enjeu : des modifications itératives qui gardent le visage, gardent l'éclairage et gardent le monde cohérent — et ne changent pas discrètement la réalité sous vos yeux.
Le timing est évident : la récente vague d'éloges pour Nano Banana Pro avait suscité des discussions sur le fait que Google commençait à — oh là là ! — dépasser OpenAI et changer la course à l'IA. Nano Banana et Nano Banana Pro de Google — les surnoms adaptés aux mèmes pour les modèles d'image Gemini qui peuvent générer et modifier des images de manière conversationnelle — ont attiré l'attention précisément pour ce type de magie « créez cette chose spécifique, puis modifiez-la sans la casser » qui transforme un outil en tendance.
Les propres documents de développement de Google associent la marque à la plomberie : Gemini 2.5 Flash Image pour Nano Banana, et Gemini 3 Pro Preview pour Nano Banana Pro. Et l'argument de vente de Google pour Nano Banana Pro s'appuie sur des contrôles de caméra et d'éclairage, des maquettes construites à partir de plusieurs images, et des sorties riches en texte telles que des affiches et des diagrammes. Google a présenté Nano Banana Pro comme capable de mélanger des compositions complexes en utilisant jusqu'à 14 images tout en conservant la cohérence et la ressemblance de jusqu'à cinq personnes, ainsi qu'un meilleur texte pour les affiches, les invitations et les diagrammes riches en contexte.
OpenAI essaie de gagner le même type de répétabilité à l'intérieur de ChatGPT. Son propre post présente GPT Image 1.5 comme meilleur pour préserver les logos de marque et les visuels clés à travers les modifications, utile pour les équipes de commerce électronique construisant des catalogues d'images de produits complets à partir d'une seule image source. Il indique également que les entrées et sorties d'image sont 20% moins chères dans GPT Image 1.5 que dans GPT Image 1. Les documents de tarification d'OpenAI listent gpt-image-1.5 à 8 $ pour 1 million de jetons d'image d'entrée, 2 $ pour 1 million d'entrées mises en cache, et 32 $ pour 1 million de jetons d'image de sortie.
Google, quant à lui, essaie d'éviter que la banane ne devienne un problème de confiance. Les pages de modèles AI Studio indiquent que les images créées ou éditées avec Gemini 2.5 Flash Image incluent un filigrane SynthID invisible, et TechRadar rapporte que Google utilise également un filigrane “Gemini sparkle” visible pour les utilisateurs des niveaux gratuit et Pro tout en supprimant le filigrane visible pour les abonnés Ultra et dans AI Studio. L'argument de vente de Google Nano Banana Pro, quant à lui, met en avant les contrôles de caméra et d'éclairage, les maquettes construites à partir de plusieurs images, et les sorties riches en texte telles que des affiches et des diagrammes — les éléments pratiques qui empêchent un générateur d'images de ressembler à un stand de carnaval à un seul tour.
Google a jeté une peau de banane sur la piste de course de l'IA. Mais OpenAI n'a pas trébuché — il a accéléré.
