OpenAI dévoile GPT-5.5 et veut faire une remontada historique face à Claude et Gemini
Deux jours après le lancement réussi du nouveau générateur d'images ChatGPT Images 2.0, OpenAI dévoile GPT-5.5, autrefois connu sous le nom de code « Spud ». Un modèle pensé pour agir de manière autonome et qui a pour lourde tâche de reprendre la couronne à Anthropic... quitte à faire gonfler les prix.

Malmené en fin d'année par Google et ses modèles Gemini 3, OpenAI a ensuite subi l'incroyable dynamique de son pire ennemi : Anthropic. Entre l'engouement des développeurs pour l'écosystème Claude (Cowork, Claude Code), le buzz savamment orchestré autour du projet de cybersécurité Mythos et une omniprésence médiatique, la start-up fondée par des anciens d'OpenAI est aujourd'hui dans une très bonne forme. Anthropic s'attend même à gagner plus d'argent que ChatGPT dès cette année et a récemment lancé Claude Opus 4.7, qu'il présente comme le meilleur modèle du marché.
La remontada d'OpenAI est-elle imminente ? Après avoir lancé ChatGPT Images 2.0, un générateur d'images qui inonde les réseaux sociaux de fausses affiches de football virales, le géant de l'IA annonce le 23 avril GPT-5.5, connu jusqu'ici sous le nom de code « Spud ». Il s'agit, selon lui, du meilleur modèle du marché de très loin.
GPT-5.5 : quelles nouveautés pour le modèle d'OpenAI ?
Avec GPT-5.5, OpenAI est ambitieux. L'entreprise suggère que son modèle est presque autonome.

Là où les modèles précédents nécessitaient des instructions par étapes ultra-précises, GPT-5.5 est conçu pour comprendre l'ambiguïté des demandes. Vous pouvez désormais lui confier une tâche longue et brouillonne, il va planifier de lui-même les étapes, utiliser les outils (recherche, tableur, code), vérifier son travail, et corriger ses erreurs sans vous solliciter à chaque blocage.
Toujours selon OpenAI, GPT-5.5 est un modèle capable de s'attaquer à la recherche scientifique de pointe. OpenAI affirme que le modèle a été capable de prouver un fait asymptotique inédit sur les nombres de Ramsey (en mathématiques) et qu'il excelle sur l'analyse de données en génétique (GeneBench). Les benchmarks battent tous des records : OpenAI n'a pas été aussi haut depuis des mois.
Malgré un bond massif en matière de raisonnement, GPT-5.5 est aussi rapide pour répondre que GPT-5.4 et utilise nettement moins de tokens pour arriver au résultat, selon l'entreprise. Mais son coût d'utilisation augmente : GPT-5.5 est un modèle plus cher que GPT-5.4.
OpenAI accuse Anthropic d'avoir menti
Pour prouver qu'il a repris la couronne, OpenAI a publié une série de benchmarks. Et l'entreprise n'y est pas allée de main morte, accusant subtilement Anthropic d'avoir triché (ou « mémorisé ») certaines données sur les tests de code.
| GPT-5.5 | Claude Opus 4.7 | Gemini 3.1 Pro | |
|---|---|---|---|
| Terminal-Bench 2.0 (Ligne de commande) | 82,7 % | 69,4 % | 68,5 % |
| GDPval (Tâches professionnelles) | 84,9 % | 80,3 % | 67,3 % |
| OSWorld (Utilisation autonome d'un PC) | 78,7 % | 78,0 % | - |
| SWE-Bench Pro (Code / Bugs Github) | 58,6 % | 64,3 %* | 54,2 % |
Si Gemini 3.1 Pro garde une légère avance sur certaines logiques pures (ARC-AGI-1), GPT-5.5 écrase la concurrence sur l'utilisation du terminal, la bureautique (GDPval) et la cybersécurité (CyberGym).
GPT-5.5 coûte plus cher et n'est pas disponible pour tout le monde
Pour la première fois depuis longtemps, un nouveau modèle n'est pas disponible pour tout le monde. GPT-5.5 est réservé aux abonnés payants (Plus, Pro, Business et Enterprise). Les millions d'utilisateurs gratuits de ChatGPT resteront bloqués sur GPT-5.4.
Pour les tâches les plus lourdes, OpenAI réserve un modèle GPT-5.5 Pro aux abonnés des tiers supérieurs (Pro, Business, Enterprise), comme il le faisait déjà précédemment.
Cette inflation se confirme aussi du côté des développeurs. Sur l'API, le prix de GPT-5.5 est le double de celui de GPT-5.4 : 5 $ pour 1 million de tokens en entrée, et 30 $ pour 1 million en sortie (et jusqu'à 180$ en sortie pour la version Pro !).
publié le , Nicolas Lellouche de Numerama
