Chargement…

ChatGPT 6 est vraiment puissant

ChatGPT 6 est vraiment puissant

J'ai des tâches que je fais tourner en continue par des IA pour les benchmarker et faire vivre de petits projets.

Notamment, faire tourner des IA sur du binaire pour de la décompilation etc... C'est un excellent sujet pour tester à quel point les IA progressent... Car le sujet est complexe, il demande de l'autonomie sur la partie exploratoire et de l'organisation pour la décompilation séquentielle.

Et en ce moment je teste GPT 6 sur la décompilation de Tomb Raider 5 Playstation, donc un portage PC si vous voulez.

Que vaut GPT 6 Astra ?

Déjà, laissez moi vous dire qu'il avance à pas de géant.

J'ai commencé ce projet, qui tourne en continue, depuis quelques mois.

A l'époque j'avais commencé avec GPT 5.5. Puis je suis passé à GPT 5.6 Sol...

Et entre temps, la fenêtre de 5h a disparu côté OpenAI pour laisser place à une fenêtre hebdomadaire unique.

Donc je le vois progresser par rapport à la roadmap fixée et le rythme n'était pas fou. Le modèle pouvait passer plusieurs jours sur un sujet unique. Que ce soit l'éclairage, ou la gravité...

Je ne vous cache pas que parfois je me suis même demandé s'il ne tournait pas en boucle et j'ai fait faire une passe avec d'autres IA pour vérifier les progressions. Et non, il avançait bien... mais très lentement !

Quand GPT 6 est sorti, j'ai basculé sur cette version.

Premièrement laissez moi vous dire qu'au niveau performance, on a changé de dimension.

Ce que vend Altman lorsqu'il parle d'AGI n'est peut être pas exagéré, le modèle est une brute de code.

La progression est désormais incroyable, je passe d'une épique à l'autre dans la même journée désormais. Je vous fournirai bientôt les premiers screenshots.

Pour autant, est-ce que tout est parfait ?

Attention à la dépense en token

Alors oui, je viens de vous parler de la vitesse d'exécution et j'en suis très satisfait.

GPT 6 Astra est un modèle très performant. Probablement, le plus performant au moment où l'on parle.

En revanche, la consommation de token aussi a augmenté et pas qu'un peu.

Comme je vous disais, je laisse tourner ces agents en autonomie sur des serveurs.

La décompilation est une sorte de tâche de fond en continue qui me permet de les évaluer.

Mais GPT 6 Astra a réussi à me vider mes tokens hebdomadaire en une seule session de 15h à 21h.

Il m'a pris 100% de ma fenêtre de token, alors que ça n'était jamais arrivé avec GPT 5.6 Sol, où je perdais au maximum 10% de token en une journée.

Heureusement OpenAI a prévu le coup avec des actions de reset que l'on peut utiliser au besoin.

J'en avais 3... J'imagine pour prévoir le coup en cas de boucle.

Donc si je devais résumer GPT 6 Astra, je dirais: extrêment performant, mais attention à la consommation.

FAQ

GPT 6 Astra est-il vraiment plus performant que GPT 5.6 Sol ?

Oui, très nettement. Là où GPT 5.6 Sol pouvait rester bloqué plusieurs jours sur un sujet comme l'éclairage ou la gravité, GPT 6 Astra enchaîne désormais plusieurs épiques dans la même journée sur le projet de décompilation.

Pourquoi la consommation de tokens explose avec ce modèle ?

GPT 6 Astra travaille beaucoup plus vite et de manière plus intensive, ce qui se traduit par une consommation de tokens nettement supérieure. Une seule session de six heures a suffi à épuiser toute la fenêtre hebdomadaire, contre 10 pourcent maximum par jour avec GPT 5.6 Sol.

Comment éviter de se retrouver bloqué si les tokens sont épuisés en cours de semaine ?

OpenAI propose des actions de reset à utiliser en cas de besoin, ce qui permet de continuer à faire tourner ses projets même après avoir épuisé son quota. Il vaut mieux les réserver pour de vraies urgences plutôt que de les consommer trop vite.

Pourquoi la décompilation de jeux est-elle un bon test pour évaluer une IA ?

Ce type de tâche combine exploration autonome et organisation rigoureuse sur la durée, ce qui met à l'épreuve à la fois la capacité de raisonnement du modèle et sa constance. C'est un bon indicateur concret des progrès réels d'une IA, au-delà des benchmarks classiques.

Faut-il craindre que le modèle tourne en boucle sans avancer ?

C'est une inquiétude légitime quand la progression semble lente, comme cela a été le cas avec GPT 5.6 Sol. Faire vérifier l'avancement par une autre IA permet de confirmer si le modèle progresse réellement ou s'il stagne.


Poursuivre la lecture

IBM veut réduire la consommation de token News
#ia#consommation de tokens#llm

IBM veut réduire la consommation de token

IBM confronte ALTK-Evolve à ACE sur AppWorld pour repenser la mémoire des agents IA et son coût réel en tokens : la méthodologie du comparatif mérite qu'on s'y attarde.

Alexandre P.
GPT 5.5 bridé ? News
#ia#code agentique#openai

GPT 5.5 bridé ?

GPT-5.5 serait plus économe en tokens, mais une anomalie statistique révélée par la communauté soulève une question plus gênante : moins de tokens signifie-t-il aussi moins de bonnes réponses ?

Alexandre P.