OpenAI n'a pas attendu que la poussière retombe après les lancements de Claude Opus 4.6 et Gemini 3.1 Pro pour dégainer. GPT-5.4, dévoilé le 5 mars, arrive en trois déclinaisons, standard, Thinking et Pro, et embarque une fonctionnalité que la concurrence louchait depuis des mois, le computer use natif. Concrètement, l'IA peut désormais piloter directement votre ordinateur, cliquer sur des boutons, naviguer sur le web et enchaîner des actions entre plusieurs applications sans intervention humaine.
Votre PC, son terrain de jeu

GPT-5.4 regarde votre écran, manipule une souris virtuelle, remplit des formulaires et navigue sur le web en totale autonomie. OpenAI a d'ailleurs lancé en parallèle des plugins financiers pour Excel et Google Sheets intégrant les données de FactSet, MSCI et Moody's, histoire de transformer ChatGPT en analyste junior pour les équipes finance. Sur un benchmark de modélisation tableur, GPT-5.4 atteint 87,3 % de réussite contre 68,4 % pour son prédécesseur GPT-5.2, un bond considérable en une seule itération.
Côté spécifications, la fenêtre de contexte grimpe à 1 050 000 tokens (via l'API et Codex), la sortie maximale passe à 128 000 tokens, et un nouveau système de tool search réduit la consommation de tokens de 47 % sur les workflows complexes en ne chargeant les définitions d'outils qu'à la demande.
Des benchmarks solides, mais une course loin d'être gagnée
Sur OSWorld-Verified, qui mesure la capacité à réaliser des tâches sur un vrai système d'exploitation, GPT-5.4 atteint 75,0 %, au-dessus du score humain de référence (72,4 %) et devant Claude Opus 4.6 (72,7 %). En matière de factualité, les réponses comportent 33 % d'affirmations fausses en moins et 18 % d'erreurs globales en moins par rapport à GPT-5.2. Sur GDPval, le benchmark de tâches professionnelles, le score passe de 70,9 % à 83,0 %.

Mais la photo n'est pas uniformément flatteuse. En code, GPT-5.4 plafonne à 57,7 % sur SWE-Bench Pro alors que Claude Opus 4.6 d'Anthropic domine encore ce terrain. Et Gemini 3.1 Pro, lancé mi-février par Google, conserve la couronne du raisonnement scientifique avec 94,3 % au GPQA Diamond. La guerre des modèles en 2026 ressemble de plus en plus à un triathlon où chaque concurrent excelle sur une épreuve différente.
Qui y a accès, et à quel prix
GPT-5.4 est disponible immédiatement pour les abonnés ChatGPT Plus, Team et Pro, ainsi que via l'API. Les utilisateurs gratuits conservent GPT-5 par défaut mais basculent sur GPT-5 mini une fois leur quota atteint. Côté API, comptez 2,50 $ par million de tokens en entrée et 15 $ en sortie, avec un surcoût de 2× au-delà de 272 000 tokens de contexte.

Après le lancement de GPT-5.3-Codex début février, dont les acquis en ingénierie logicielle sont directement intégrés dans ce nouveau modèle, OpenAI maintient un rythme de publication mensuel qui force Anthropic et Google à répondre en permanence. La question n'est plus de savoir si l'IA peut remplacer certaines tâches humaines, mais combien de temps avant qu'elle ne le fasse sans qu'on ait besoin de le lui demander.




