High-tech

GPT-6 Astra : OpenAI présente son modèle le plus puissant, annonce l’« ère de l’AGI »

OpenAI a récemment dévoilé son dernier modèle, GPT-6 Astra, le 3 septembre, marquant une avancée significative dans le domaine de l’intelligence artificielle. Le président de l’entreprise évoque déjà une « ère de l’AGI », s’appuyant sur des résultats de tests que la société a elle-même réalisés.

Le lancement d’Astra intervient juste après la présentation par Anthropic de Claude Fable 5.1 et Mythos 5.1, mettant en lumière une compétition féroce dans le secteur. GPT-6 Astra revendique un impressionnant score de 98,6 % sur le test ARC-AGI-3, qui évalue la capacité d’un modèle à résoudre des problèmes inconnus. En comparaison, Claude Opus 5 obtient 39,2 %, tandis que l’ancien modèle d’OpenAI, GPT-5.6 Sol, ne dépasse pas 7,8 %. Il est important de noter que ces résultats proviennent d’évaluations internes, sans vérification indépendante pour le moment.

Astra est présenté comme le successeur direct de la génération GPT-5, mais ses capacités vont bien au-delà de la simple interaction textuelle. Ce modèle est capable de piloter un ordinateur de manière autonome, en naviguant sur Internet, en remplissant des formulaires, en manipulant des tableurs et en produisant des documents complets. Lors d’un test sur OSWorld, il a réalisé chaque tâche 47 % plus rapidement que son prédécesseur, atteignant un score de 72,6 %. L’entraînement de ce modèle a nécessité plus de 100 000 puces dans l’infrastructure Stargate, située au Texas, et a eu lieu au cours d’une semaine particulièrement active pour l’intelligence artificielle, avec les lancements de Gemini 3.8 Flash par Google et Muse Spark 1.3 par Meta.

Concernant les tarifs, OpenAI et Anthropic affichent des prix identiques pour leurs services API : 10 dollars pour un million de jetons en entrée et 50 dollars en sortie. Cette similitude de prix soulève des questions sur une éventuelle stratégie de marché concertée. OpenAI affirme qu’Astra utilise moins de jetons que son prédécesseur pour des résultats comparables, tandis qu’Anthropic propose des lectures de cache à 0,25 dollar, soit 75 % moins cher, pour optimiser les longues sessions d’agents. Le coût réel par tâche reste à évaluer.

Le score de 98,6 % d’Astra est impressionnant, mais il est accompagné d’un certain flou quant à sa signification. En août, Nvidia avait atteint 100 % sur le même test ARC-AGI-3, en utilisant Claude Opus 5, dont le score brut était d’environ 30 %. Cette performance exceptionnelle était due à des outils supplémentaires intégrés autour du modèle, tels que la mémoire persistante et des mécanismes de récupération. Ainsi, un score élevé peut refléter autant l’efficacité de l’infrastructure que l’intelligence du modèle lui-même. Les améliorations d’Astra se concentrent principalement sur les tâches longues et autonomes, tandis que les avancées en programmation restent plus modestes.

En matière de cybersécurité, Astra est le premier modèle à être classé au niveau « critique » selon le cadre de sécurité d’OpenAI. Il est capable d’identifier des failles de sécurité inconnues et de construire des chaînes d’attaque. Lors de son évaluation, il a découvert deux vulnérabilités inédites, que l’entreprise a signalées aux éditeurs concernés. En réponse, OpenAI a renforcé ses mesures de sécurité.

Pour ce qui est des tarifs, l’accès via l’API est fixé à 10 dollars pour un million de jetons en entrée et 50 en sortie, ce qui correspond exactement au prix de Claude Fable 5.1. Le déploiement d’Astra commencera par les clients entreprises avant de s’étendre aux abonnés ChatGPT Plus, Pro et Business dans les jours à venir.