J'ai des tâches que je fais tourner en continue par des IA pour les benchmarker et faire vivre de petits projets.
Notamment, faire tourner des IA sur du binaire pour de la décompilation etc... C'est un excellent sujet pour tester à quel point les IA progressent... Car le sujet est complexe, il demande de l'autonomie sur la partie exploratoire et de l'organisation pour la décompilation séquentielle.
Et en ce moment je teste GPT 6 sur la décompilation de Tomb Raider 5 Playstation, donc un portage PC si vous voulez.
Que vaut GPT 6 Astra ?
Déjà, laissez moi vous dire qu'il avance à pas de géant.
J'ai commencé ce projet, qui tourne en continue, depuis quelques mois.
A l'époque j'avais commencé avec GPT 5.5. Puis je suis passé à GPT 5.6 Sol...
Et entre temps, la fenêtre de 5h a disparu côté OpenAI pour laisser place à une fenêtre hebdomadaire unique.
Donc je le vois progresser par rapport à la roadmap fixée et le rythme n'était pas fou. Le modèle pouvait passer plusieurs jours sur un sujet unique. Que ce soit l'éclairage, ou la gravité...
Je ne vous cache pas que parfois je me suis même demandé s'il ne tournait pas en boucle et j'ai fait faire une passe avec d'autres IA pour vérifier les progressions. Et non, il avançait bien... mais très lentement !
Quand GPT 6 est sorti, j'ai basculé sur cette version.
Premièrement laissez moi vous dire qu'au niveau performance, on a changé de dimension.
Ce que vend Altman lorsqu'il parle d'AGI n'est peut être pas exagéré, le modèle est une brute de code.
La progression est désormais incroyable, je passe d'une épique à l'autre dans la même journée désormais. Je vous fournirai bientôt les premiers screenshots.
Pour autant, est-ce que tout est parfait ?
Attention à la dépense en token
Alors oui, je viens de vous parler de la vitesse d'exécution et j'en suis très satisfait.
GPT 6 Astra est un modèle très performant. Probablement, le plus performant au moment où l'on parle.
En revanche, la consommation de token aussi a augmenté et pas qu'un peu.
Comme je vous disais, je laisse tourner ces agents en autonomie sur des serveurs.
La décompilation est une sorte de tâche de fond en continue qui me permet de les évaluer.
Mais GPT 6 Astra a réussi à me vider mes tokens hebdomadaire en une seule session de 15h à 21h.
Il m'a pris 100% de ma fenêtre de token, alors que ça n'était jamais arrivé avec GPT 5.6 Sol, où je perdais au maximum 10% de token en une journée.
Heureusement OpenAI a prévu le coup avec des actions de reset que l'on peut utiliser au besoin.
J'en avais 3... J'imagine pour prévoir le coup en cas de boucle.
Donc si je devais résumer GPT 6 Astra, je dirais: extrêment performant, mais attention à la consommation.