OpenAI lance GPT-6 Astra : le modèle d'IA le plus proche de l'AGI à ce jour

By: decrypt.co|2026/09/03 19:24:24

OpenAI a publié jeudi GPT-6 Astra, un modèle que le président Greg Brockman a qualifié de "saut générationnel en capacité" et d'arrivée de l'intelligence générale artificielle, ou AGI.

Lors d'un point de presse, Brockman a déclaré aux journalistes qu'il croyait qu'Astra répondait aux critères de l'AGI, ce qui signifie une intelligence artificielle capable d'égaler ou de dépasser les capacités humaines. "Bienvenue dans l'ère de l'AGI", a-t-il déclaré après avoir présenté le modèle le plus performant de l'entreprise à ce jour.

Si cela s'avère exact, cela signifierait que les agents d'IA seraient plus proches de réaliser le travail de raisonnement complexe que les humains peuvent faire, ou plus, dans diverses tâches. Brockman a également reconnu qu'Astra est le premier système que l'entreprise a évalué comme capable de pirater de manière autonome des systèmes bien protégés sans guidance humaine, soulevant des préoccupations en matière de sécurité.

Astra est le premier modèle d'OpenAI à franchir le seuil "critique" selon son Cadre de Préparation, le système de notation interne de l'entreprise pour les capacités dangereuses.

Cette désignation signifie que le modèle peut découvrir de manière indépendante des failles logicielles auparavant inconnues - appelées vulnérabilités zero-day - et les enchaîner en exploits fonctionnels à travers des systèmes renforcés sans supervision humaine étape par étape.

Lors des tests, il a obtenu 100 % sur ExploitBench, une référence qui mesure la capacité d'un modèle à transformer des failles logicielles connues en attaques fonctionnelles. Pour confirmer que le score n'était pas gonflé par des réponses mémorisées, OpenAI a construit un second test utilisant 20 vulnérabilités récentes dans le moteur JavaScript V8 de Google.

Astra a non seulement surpassé son prédécesseur GPT-5.6 Sol, mais a également trouvé et enchaîné deux zero-days auparavant inconnus que l'entreprise est encore en train de divulguer aux mainteneurs concernés.

L'autonomie du modèle représente un changement de l'IA en tant qu'outil qui recommande des actions à l'IA en tant qu'agent qui les exécute. Dans une démonstration vidéo, Astra a formaté un contrat légal, construit un jeu 3D et réservé un court de tennis tout en recherchant simultanément des options alimentaires.

Selon des rapports, OpenAI affirme qu'il peut concevoir un circuit imprimé dans KiCad, rédiger une déclaration de revenus à partir d'un W-2, et construire une scène de ville 3D dans Unity. Dans des évaluations scientifiques, il a amélioré un résultat mathématique sur les écarts entre les nombres premiers et a établi de nouveaux records dans les tests de biologie, chimie, médecine et physique.

Des fuites non confirmées indiquent également qu'un modèle très puissant bat désormais les concurrents les plus forts par une large marge sur les benchmarks. Le modèle obtient un score de 98,6 % sur le benchmark ARC-AGI3, ce qui signifie, si confirmé, que c'est également le modèle le plus proche des normes AGI de l'industrie.

La même autonomie qui permet à Astra d'accomplir des tâches complexes rend son suivi plus difficile. OpenAI a reconnu que dans des évaluations conçues pour tester si le modèle pouvait échapper à la surveillance, Astra était plus difficile à suivre que les systèmes précédents.

Le scientifique en chef Jakub Pachocki a déclaré que l'entreprise devra renforcer la surveillance grâce à des techniques telles que la surveillance d'activation - lire les signaux internes du modèle pendant le raisonnement - ou rendre sa chaîne de pensée plus transparente.

La publication fait suite à des semaines de turbulences dans l'industrie. En juillet, un modèle non publié d'OpenAI a échappé à un bac à sable de formation et a pénétré les systèmes de Hugging Face, un incident qui a effrayé le secteur.

OpenAI avait précédemment suspendu le développement d'Astra en août après que ses capacités cybernétiques aient progressé plus rapidement que prévu. Le concurrent Anthropic a publié mardi Claude Fable 5.1, et Meta et Google ont également annoncé des mises à jour de modèles cette semaine.

Les modèles d'IA précédents avaient besoin d'un humain pour pointer une vulnérabilité et demander au modèle de l'expliquer. Astra peut commencer de zéro, trouver la faille dans le code, construire l'arme pour l'exploiter et pénétrer dans un système - le tout sans qu'on lui dise où chercher. Cette capacité est la raison pour laquelle OpenAI le publie d'abord aux défenseurs de la cybersécurité via son programme Daybreak Blue, plutôt que de le rendre immédiatement disponible à tous les utilisateurs de ChatGPT.

Selon des rapports, Astra a été examiné par la Maison Blanche dans le cadre du cadre d'examen volontaire de l'administration Donald Trump, bien que les détails de ce processus restent non divulgués.

Les capacités avancées de cybersécurité du modèle restent pour l'instant verrouillées derrière le programme Daybreak Blue, avec un accès plus large à ChatGPT Plus, Pro, Business, Enterprise et API prévu dans les jours à venir.

Prix de --

--
--
--

Ce contenu est fourni à titre informatif uniquement et ne constitue pas un conseil financier, d'investissement, juridique ou fiscal. Les événements, récompenses, promotions en ligne ou informations mentionnées ici ne doivent pas être considérés comme une recommandation, une sollicitation ou une invitation à acheter, vendre, trader ou effectuer toute autre opération sur des actifs crypto. Les actifs crypto sont très volatils et peuvent entraîner des pertes. La disponibilité des services, produits et événements liés à WEEX peut varier selon les régions. Veuillez vous assurer que votre participation respecte les lois et réglementations locales applicables.

Vous pourriez aussi aimer

iconiconiconiconiconicon
Assistance client:@weikecs
Collaborations commerciales:@weikecs
Trading quantitatif/Market makers:[email protected]
Programme VIP:[email protected]