Sam Altman a promis "une intelligence de niveau doctorat." Les utilisateurs ont obtenu un modèle qui pense que l'Oregon s'appelle "Onegon" et que Joe Biden est toujours président.
La dernière version du chatbot d'OpenAI a déçu les utilisateurs et commis quelques erreurs humoristiques.

Nikolas Kokovlis/NurPhoto via Getty Images
Sam Altman a promis "une intelligence de niveau doctorat." Les utilisateurs ont obtenu un modèle qui pense que l'Oregon s'appelle "Onegon" et que Joe Biden est toujours président.
Le GPT-5 d'OpenAI, présenté comme l'IA la plus avancée de la société à ce jour, a suscité une déception et un ridicule généralisés depuis son lancement jeudi, les utilisateurs signalant des erreurs basiques qui ont ravivé les débats sur la question de savoir si l'approche d'expansion de l'industrie de l'IA a atteint une impasse.
La réaction a été rapide et brutale. Les réseaux sociaux se sont enflammés avec des captures d'écran des erreurs bizarres du GPT-5, comme des cartes étiquetant l'Oklahoma comme "Gelahbrin", des problèmes de mathématiques basiques comme "5.9 = x + 5.11" mal résolus, et chronologies mettant en vedette des présidents fictifs comme "Willian H. Brusen."
"Le consensus écrasant sur GPT-5 de la part de X $TWTR et du Reddit $RDDT AMA est extrêmement négatif," a noté le compte AI Leaks and Newsalors qu'un sondage informel a révélé que la plupart des utilisateurs évaluaient le modèle comme simplement "Un peu moyen."
Pourtant, l'accueil n'a pas été uniformément négatif. OpenAI a rapporté que le trafic de l'API avait doublé dans les 24 heures suivant le lancement, et certains premiers utilisateurs ont loué les capacités de codage et la production créative de GPT-5. Le PDG de Box, Aaron Levie a souligné des améliorations majeures dans l'extraction de données à partir de documents juridiques complexes. Le professeur de Wharton, Ethan Mollick a noté la capacité de l'IA à anticiper les besoins des utilisateurs et à fournir des résultats complets au-delà des demandes de base. Le développeur Simon Willison a écrit que GPT-5 est "mon nouveau modèle préféré."
Cependant, ces critiques positives ont été éclipsées par le verdict sévère du marché. Sur Polymarket, une plateforme de prédiction où les traders parient sur des événements futurs, les chances d'OpenAI d'avoir la meilleure IA modèle d'ici la fin du mois se sont effondrées de 75 % à 14 % en une seule heure jeudi soir.
Vendredi, un Sam Altman contrit tentait de limiter les dégâts sur Reddit après que des utilisateurs ont posté des commentaires comme "GPT-5 porte la peau de mon ami décédé" and a lancé une pétition Change.org. He promised to restore GPT-4o access (which OpenAI did by Friday evening) et a admis que un "autoswitcher" défectueux entre les différents modes de GPT-5 avait rendu le modèle "sembler beaucoup plus stupide" que prévu. Le mea culpa a marqué un renversement étonnant pour un PDG qui, seulement 24 heures tôt avait déclaré que sa dernière création "était clairement un modèle généralement intelligent."
Le fiasco soulève des questions fondamentales sur la question de savoir si la stratégie centrale de l'industrie de l'IA de construire des modèles toujours plus grands a atteint un mur. Les critiques ont longtemps soutenu que simplement augmenter l'échelle des modèles ne mènerait pas à une intelligence générale artificielle, et les faux pas de GPT-5 semblent valider ces préoccupations.
"Mon travail ici est vraiment terminé," a écrit Gary Marcus, un chercheur en IA et un critique de longue date des approches actuelles de développement des LLM. "Personne avec une intégrité intellectuelle ne peut encore croire que le simple passage à l'échelle nous mènera à l'AGI." Les problèmes provenant de ce qui était présenté comme un outil de niveau doctorat suggèrent des limitations fondamentales dans la manière dont les grands modèles de langage traitent l'information, et non seulement des problèmes infantiles qui peuvent être résolus avec des correctifs.
Le moment ne pourrait pas être pire pour OpenAI. Le groupe AI d'Alibaba a annoncé son modèle Qwen 3 avec un contexte de 1 million de tokens, permettant des conversations presque quatre fois supérieures à celles offertes par GPT-5. Pendant ce temps, le Claude Opus 4.1 d'Anthropic tient le rythme dans les benchmarks de codage, et Gemini, après un départ tardif, gagne du terrain. Ce qui était censé consolider la domination d'OpenAI a plutôt offert un cadeau aux rivaux.
Les enjeux sont énormes pour une entreprise qui vient de lever 8,3 milliards de dollars pour une valorisation de 300 milliards de dollars et brûle de l'argent en frais de calcul. Le chiffre d'affaires annuel d'OpenAI a atteint 13 milliards de dollars, mais l'entreprise reste déficitaire, rendant chaque erreur coûteuse. Le lancement raté survient également alors que les concurrents se rapprochent, avec Meta $META qui proposerait des offres à plusieurs milliards de dollars pour débaucher les talents d'OpenAI.
OpenAI prévoit de déployer de nouvelles fonctionnalités de productivité la semaine prochaine, y compris l'intégration de Gmail et de Google $GOOGL Calendar, et a historiquement résolu les problèmes de lancement au fil du temps. Mais pour un modèle sur lequel l'entreprise avait travaillé depuis fin 2023, l'accueil n'est probablement pas ce qu'OpenAI espérait. En janvier, Altman a écrit que << nous sommes maintenant confiants que nous savons comment construire l'AGI >> - une confiance qui semble prématurée étant donné un modèle qui ne peut pas correctement étiqueter l'Oregon sur une carte.
Rejoignez plus de 500 000 lecteurs qui commencent leur journée avec Quartz.
En vous abonnant, vous acceptez nos Conditions d'utilisation et notre Politique de confidentialité.