10 jours après avoir promis de "ralentir la frontière", OpenAI sort 2 modèles et se compare frontalement à Anthropic. La compétition n'a pas disparu, elle a changé de terrain.
Mais on n'avait pas dit qu'on levait le pied ?
Le 12 septembre, Dario Amodei publie son essai "We Must Pace the Frontier".
Dans les heures qui suivent, Sam Altman, Elon Musk et Demis Hassabis applaudissent. 4 concurrents d'accord en un après-midi, c'est du jamais vu.
Sauf qu'il faut lire ce qui a réellement été promis :
- pas de pause (Altman l'a précisé lui-même : "pacing" ne veut pas dire "stopping")
- pas de seuil chiffré, pas de calendrier
- un seul engagement concret : des évaluateurs indépendants embarqués dans les labs
10 jours plus tard, OpenAI lance GPT-6 Sol et Luna en réponse à Opus 5.5 dont je vous parlais ici. Et le billet d'annonce aligne les benchmarks face à Claude Opus 5 et Fable 5.1, tableau après tableau.
Donc non, la concurrence n'est pas finie.
Et ce n'est pas de la perf, c'est de l'optimisation
OpenAI met les scores en vitrine. Mais le vrai sujet, c'est la facture :
- Sol passe de 4 $ / 20 $ à 2 $ / 10 $ le million de tokens (input / output) toujours en réponse à Opus 5.5 dont les prix baissent aussi
- Luna passe de 0,20 $ / 1,20 $ à 0,10 $ / 0,50 $ en réponse à Deepseek 4.1 Flash
- le prompt caching est amélioré, avec 90 % de remise sur les lectures en cache
Côté perf, il faut séparer les chiffres d'OpenAI (auto-déclarés, sur des benchs choisis par OpenAI) de ceux d'Artificial Analysis.
Et chez Artificial Analysis, le discours dégonfle vite. Sur l'Intelligence Index, Sol et Luna restent au niveau de GPT-5.6. Luna régresse même sur le Coding Agent Index.
Le coût par tâche est bien divisé par 2. Mais c'est la baisse de prix qui fait tout le travail : les 2 modèles consomment même un peu plus de tokens en sortie.
Même intelligence, facture divisée par 2. C'est de l'optimisation d'inférence et de la politique tarifaire, pas un saut de capacité.
Au passage, OpenAI raisonne enfin en coût par tâche plutôt qu'en coût par token.
Et je ne vais pas m'en plaindre. J'ai migré mes services en prod de Sonnet 5 vers DeepSeek V4.1-Flash, et je suis passé d'environ 30 centimes à 4 centimes par jour de process. Pour l'utilisateur, cette guerre des prix, c'est tout bénéf.