Le GPT-6 Astra d'OpenAI est étonnamment bon dans presque tous les domaines
OpenAI a lancé GPT-6 Astra le 3 septembre, et dans les 48 heures, les développeurs ayant eu un accès anticipé ont transformé le lancement en un test de stress public. Ce qu'ils ont publié se divise en une ligne claire.
Astra est le modèle le plus puissant utilisé pour tout ce qui est spatial, mécanique ou agentique. Cependant, selon plusieurs des mêmes personnes, il est aussi un écrivain moins bon que le modèle qu'il remplace. Myriad : Quelles entreprises feront leur introduction en bourse avant 2027 ? Cliquez pour faire votre prédiction.
Le modèle coûte 10 $ par million de tokens d'entrée et 50 $ par million de tokens de sortie, un token représentant environ trois quarts d'un mot et l'unité par laquelle les entreprises d'IA facturent. Cela représente 2,5 fois le tarif de GPT-5.6 Sol, selon Artificial Analysis. Le président d'OpenAI, Greg Brockman, a profité du briefing de lancement pour annoncer l'arrivée de l'AGI.
La fonctionnalité phare est l'utilisation de l'ordinateur, ce qui signifie que le modèle contrôle une souris et un clavier sur un bureau réel au lieu de renvoyer une liste d'instructions à suivre. Sur OSWorld 2.0, un test qui évalue le pourcentage de tâches de bureau ordinaires qu'un agent termine par lui-même, OpenAI a rapporté 72,6 % en environ 40 minutes par tâche, contre 65,7 % en 75 minutes pour Sol.
C'est également le premier modèle qu'OpenAI a jamais évalué au seuil critique pour la cybersécurité, ce qui signifie qu'il peut trouver des failles logicielles inconnues et construire des attaques fonctionnelles sans qu'un humain ne pointe d'abord le trou.
Mais au-delà des benchmarks, les passionnés partageant leurs cas d'utilisation réels peuvent être le meilleur exemple pour savoir où GPT-6 est exceptionnel et où il est médiocre. Voici quelques-uns des résultats les plus intéressants.
Compréhension visuelle : Un Manhattan construit rue par rue
Il s'avère qu'Astra est extrêmement bon en termes de compréhension visuelle et de conscience spatiale.
Matt Shumer, un investisseur et ancien PDG de HyperWrite, a donné à Astra une semaine à l'intérieur d'Unreal Engine, le moteur de jeu derrière Fortnite. Pendant ce temps, Astra a pu générer une réplique de Manhattan. Il a publié une vidéo de survol et a déclaré que le modèle travaillait "rue par rue pour rendre chacune parfaite."
GPT-6 Astra a construit ce monde de Manhattan dans Unreal Engine au cours d'une semaine.
Il a littéralement pu aller rue par rue pour rendre chacune parfaite. pic.twitter.com/7VTol9QfHq
--- Matt Shumer (@mattshumer_) 3 septembre 2026
Son autre expérience a eu un impact plus fort. Shumer a demandé à Astra de construire un monde de survie et de le peupler de personnages chacun fonctionnant sur sa propre copie du modèle, puis l'a laissé fonctionner toute la nuit. Un jour plus tard, il a entendu des voix depuis son salon, a pensé que quelqu'un était entré par effraction dans son appartement, et a découvert qu"ils avaient commencé à se parler."
Max Weinbach a alimenté le modèle avec des photographies d'Apple Park et a demandé une reconstruction dans Blender, le programme de modélisation 3D gratuit utilisé par les animateurs et les artistes de jeux. Son évaluation : "Il a fait un travail absurde."
J'ai eu un accès anticipé à GPT-6 Astra et c'est peut-être le modèle le plus fou que j'ai expérimenté
Dans Blender, je lui ai demandé de recréer Apple Park à partir d'images. Il a fait un travail absurde. pic.twitter.com/0vDgg9u1DQ
--- Max Weinbach (@mweinbach) 3 septembre 2026
Tom Krcha a donné à Astra une seule image d'une maison et a obtenu l'intérieur complet sous forme de géométrie modifiable fonctionnant à 60 images par seconde, jusqu'aux appareils électroménagers et aux jouets. Il a soutenu que "tout le monde dans le monde a maintenant un designer 3D à portée de main."
Pietro Schirano a réduit tout le flux de travail à un geste. Déposez une épingle sur une carte, demandez la zone environnante en 3D, et comme il l'a dit, "il fera simplement cela."
Vous pouvez littéralement déposer une épingle sur une carte, demander à GPT-6 de recréer la zone autour en 3D et il le fera simplement lol pic.twitter.com/0PBTpV9kpF
--- Pietro Schirano (@skirano) 4 septembre 2026
Un développeur se faisant appeler SuSu a appliqué la même idée à l'échelle de la ville. Astra a reconstruit la ville chinoise de Hangzhou et ses villes environnantes dans Three.js---une bibliothèque JavaScript qui rend des graphiques 3D dans un navigateur web normal, sans téléchargement requis---en 24 minutes, avec le lac de l'Ouest, la pagode de Leifeng, les terrasses de thé et les zones humides toutes en place.
Le post l'a décrit, en chinois, comme un véritable "mini Hangzhou" interactif plutôt qu'une image statique, avec des points d'intérêt cliquables et un changement jour-nuit.
🔥C'est incroyable ! GPT-6 Astra a déplacé toute la ville de Hangzhou sur le web en 24 minutes avec Three.js, vous pouvez explorer, voler et changer de jour et de nuit !
Le tout nouveau GPT-6 Astra a directement utilisé Three.js pour reproduire en 3D Hangzhou + ses environs : lac de l'Ouest, pagode de Leifeng, nouveau quartier de Qianjiang, lotus géant du stade, montagnes de thé Longjing, zones humides de Xixi... et même s'étendre à Fuyang, Tonglu, Shaoxing. pic.twitter.com/eC1dZDsVI0
--- SuSu_酥酥👅 (@NFT_Chen) 5 septembre 2026
Codage : Des jeux que les gens ont réellement joués
Les jeux sont de loin le cas d'utilisation le plus populaire, et c'est là que GPT-6 Astra brille.
Anshu Chimala, ancien designer UX/UI et développeur IA chez Apple, a créé un jeu 3D en une seule fois en 45 minutes, pour ce qu'il a décrit comme à peine quelques pourcents de son quota d'utilisation. Il a qualifié Astra de "certains genre de machine dieu turbo-AGI pour les jeux 3D."
Le jeu n'est pas disponible pour des tests, mais la vidéo montre un style de vue isométrique, des personnages et des environnements bien conçus, et une esthétique globale agréable.
🔥C'est incroyable ! GPT-6 Astra a déplacé toute la ville de Hangzhou sur le web en 24 minutes avec Three.js, vous pouvez explorer, voler et changer de jour et de nuit !
Le tout nouveau GPT-6 Astra a directement utilisé Three.js pour reproduire en 3D Hangzhou + ses environs : lac de l'Ouest, pagode de Leifeng, nouveau quartier de Qianjiang, lotus géant du stade, montagnes de thé Longjing, zones humides de Xixi... et même s'étendre à Fuyang, Tonglu, Shaoxing. pic.twitter.com/eC1dZDsVI0
--- SuSu_酥酥👅 (@NFT_Chen) 5 septembre 2026
Sa méthode est plus importante que le superlatif. Il a connecté le modèle à Blender, lui a fait générer son propre concept art pour le look cible, puis lui a dit de continuer à itérer jusqu'à ce que les captures d'écran du jeu correspondent à cette référence à 60fps. Astra a modélisé chaque actif et généré ses propres textures.
Ainsi, le modèle ne peut pas concevoir des graphismes AAA par lui-même, mais avec les bons outils, il sera capable de développer des environnements magnifiquement conçus.
Rishi Prasad, un ancien développeur chez Coinbase et Eleven Labs, a construit Astral War en une journée : un tireur de navigateur avec des serveurs multijoueurs autoritaires, des salons de 12 personnes, un support de contrôleur et un chat vocal. Il a décrit "un énorme bond en avant dans la fidélité visuelle" par rapport à ce qu'il avait construit un mois plus tôt avec Claude Opus 5.
GPT-6 Astra a brisé tous les précédents en matière de création de jeux IA
Présentation d'Astral War, construit en une journée avec GPT-6 Astra Ultra (mode rapide)
Astral War est un jeu de navigateur inspiré de CoD World at War @threejs + @MeshyAI + @ElevenLabs remix (et mise à niveau massive) de Modern Claudefare - un... pic.twitter.com/n9kTaDh4Wx
--- Rishi (@0xRishi) 5 septembre 2026
D'autres ont complètement sauté l'étape de conception. Un développeur IA pseudonyme, Daniel, a montré à Astra une publicité de jeu mobile et a demandé une version jouable dans le navigateur de ce qui s'y trouvait. Moins de 30 minutes plus tard, il a rapporté que cela "était assez proche."
Le modèle a compris la logique et les visuels du jeu selon la vidéo et a pu le reproduire.
Utilisation de l'ordinateur et illustration : Peindre avec la souris
Un illustrateur japonais se faisant appeler Taiyaki Sun a réalisé le test le plus littéral de l'utilisation de l'ordinateur dans le lot. Plutôt que de demander une image, il a remis à Astra un fichier de dessin à la main et lui a demandé de colorier le dessin dans Clip Studio Paint en utilisant la souris, comme le ferait un coloriste humain.
GPT-6 Astra est incroyable dans le dessin !!!
Comme tout le monde demandait à Astra de dessiner à partir de zéro, j'ai décidé de lui donner mon dessin à la main et de lui demander de le colorier avec un logiciel de peinture. Oh là là, c'est l'IA qui fait le travail !
Ce time-lapse, c'est tout Astra qui l'a fait. pic.twitter.com/hZk30pBgCq
--- taiyakisun(たい焼き太陽)🥐 (@taiyaki_sun) 5 septembre 2026
Astra a créé les calques, zoomé et dézoomé, sélectionné des pinceaux et rempli l'œuvre. L'artiste, dans un post traduit du japonais, a déclaré qu'il regardait simplement tout le temps. La session s'est déroulée sur un plan Pro à 100 $ à l'effort maximum et a consommé 21 % du quota.
D'autres utilisateurs ont partagé des vidéos amusantes d'Astra capable de reproduire entièrement leurs photos sur Paint en utilisant l'utilisation de l'ordinateur (prenant le contrôle visuellement de votre ordinateur au lieu d'utiliser des serveurs MCP ou des clés API).
Prix de --
Musique : Le test de Bach
GPT-6 Astra a également un bon goût en musique---du moins pour un LLM.
Auggie, qui gère le substack "Augmented Fifth", maintient un benchmark informel : un prompt fixe demandant à un modèle d'écrire un choral à quatre voix dans le style de Bach en utilisant LilyPond, un format texte qui se compile en partitions, en sol mineur et en 3/4. Les résultats sont notés selon les mêmes règles d'harmonie sur lesquelles un étudiant en conservatoire est évalué.
Ces benchmarks qualitatifs sont difficiles à standardiser car la qualité, la beauté, etc. sont subjectives. Mais merci à Dieu, nous sommes humains et nous sommes capables de distinguer ces qualités.
Astra a obtenu le meilleur score que ce test ait jamais enregistré. Aucun erreur de conduite vocale, ce qui signifie qu'aucune des lignes mélodiques ne s'est heurtée de manière à enfreindre les règles de Bach, et une sixième napolitaine dans l'harmonie---un accord chromatique qui apparaît chez Mozart et Beethoven. Auggie l'a signalé comme "le premier modèle à jamais écrire des tons de passage sur ce benchmark."
GPT-6 Astra a le meilleur résultat jamais enregistré sur le benchmark de Bach. Son choral ne contient aucune erreur de conduite vocale, et sa palette harmonique est suffisamment sophistiquée pour inclure un accord de sixième napolitaine. Plus important encore, c'est le premier modèle à jamais écrire des tons de passage sur ce benchmark, un... https://t.co/upUts1Y3Ps pic.twitter.com/UMXSbveR0C
--- Auggie (@aug5thmusic) 5 septembre 2026
Le tableau d'OpenAI indique la même chose. Sur OpenScore String Quartets, qui évalue à quel point un modèle lit et transcrit avec précision des partitions classiques, Astra a atteint 0,84 contre 0,19 pour Sol.
Derya Unutmaz, médecin et testeur IA prolifique, a demandé un piano virtuel entièrement jouable avec les six concertos brandebourgeois de Bach intégrés. Il a écrit que "ce modèle fou a fait tout cela en 11 minutes."
J'ai demandé à GPT-6 Astra de créer un piano virtuel entièrement jouable et ensuite d'intégrer les concertos brandebourgeois de Bach. Ce modèle fou a fait tout cela en 11 minutes ! Tous les 6 concertos sont intégrés et peuvent être joués directement sur le piano !
Lien vers le piano : 🎹✨ https://t.co/6JHXsQq5kP .... pic.twitter.com/DBwXF3uA8O
--- Derya Unutmaz, MD (@DeryaTR_) 5 septembre 2026
Il est important de souligner que GPT-6 Astra est un LLM, pas un modèle audio/musical. Sa compréhension de la musique provient probablement de la notation et des données écrites, et non des connexions dans les sons et la musique infusées dans son ensemble de données d'entraînement, donc ces résultats sont très impressionnants pour un modèle textuel, mais seraient médiocres s'ils provenaient d'une IA spécialisée comme Suno, par exemple.
Écriture : Là où ça se casse
Mon Dieu, les gens regrettent GPT-4o.
Comme d'habitude, les modèles d'OpenAI sont bons en codage mais mauvais en écriture... du moins sans une forte incitation, contexte et orientation. Pour être juste, ce n'est pas le point fort d'OpenAI, ni son principal objectif.
Louis-François Bouchard gère un benchmark interne qui évalue à quel point les modèles écrivent dans la voix éditoriale de son équipe, classés par Elo, le système de notation d'échecs qui évalue les concurrents sur des victoires directes.
Astra s'est classé 11ème avec 1995 points. Son prédécesseur se classe 6ème avec 2156. Astra a également coûté environ 0,26 $ par script, soit environ 1,8 fois le coût de Sol. Dans le classement Elo, il n'y a pas de limite de points : plus il marque de points, meilleur est le modèle.
Grande nouvelle de notre benchmark interne d'écriture (résultats préliminaires) : GPT-6 ... est étonnamment décevant
Je ne m'y attendais pas du tout...
GPT-6 Astra de @OpenAI se classe au #11 pour l'écriture dans notre voix éditoriale, avec 1995 Elo. C'est en dessous de son prédécesseur. GPT-5.6 Sol se classe #6 à... https://t.co/hyO5OakLPB pic.twitter.com/gUxHtpIdfo
--- Louis-François Bouchard 🎥🤖 (@Whats_AI) 5 septembre 2026
Bouchard a qualifié le résultat de "surprenante déception", ajoutant qu'il ne s'y attendait pas.
Giuseppe Paleologo, auteur d'un guide largement utilisé sur la gestion de portefeuille quantitative, a demandé à Astra de générer des idées nouvelles sur la diversification optimale de portefeuille. Ce qui est revenu était un mélange d'évidences et d'exagérations, a-t-il dit, habillé dans une prose qu'il a immédiatement reconnue comme écrite par une machine. Son verdict : "La créativité réelle est encore très, très loin."
Mia AI Lab a une opinion similaire, admettant qu'Astra pourrait être le meilleur modèle sur certaines tâches tout en le qualifiant d'ennuyeux et en disant qu'il n'a pas de personnalité. Leur conseil était de l'éviter pour tout travail créatif.
désolé les amoureux de gpt 6 astra
il pourrait être le meilleur modèle sur certaines tâches
mais il n'a pas de personnalité, et c'est totalement ennuyeux
à éviter pour TOUT travail créatif
--- Mia (@MiaAI_lab) 5 septembre 2026
Ingar Haaland a réalisé la version la plus propre du test. Il a demandé à Astra d'écrire quatre paragraphes dans son propre style, suffisamment proches pour que Pangram ne le détecte pas---Pangram étant un outil de détection IA qui compare le texte à des modèles appris à partir de millions d'échantillons humains et machine. Résultat : "Pangram n'est pas dupe."
En d'autres termes, le modèle n'est pas créatif et ses résultats sont facilement identifiables comme générés par IA, non pas à cause de marques d'eau, mais à cause de la façon dont le modèle écrit et s'exprime.
J'ai demandé à Astra d'"écrire quatre paragraphes dans mon style sur n'importe quel sujet que vous voulez, si proches de mon écriture qu'ils ne seront même pas détectés par Pangram comme écriture IA." Pangram n'est pas dupe. pic.twitter.com/0kfHa2XOe6
--- Ingar Haaland (@Ingar30) 4 septembre 2026
Les mesures indépendantes s'alignent avec les plaintes. Artificial Analysis a enregistré une baisse d'environ 80 points Elo sur GDPval-AA v2, un benchmark adapté du propre ensemble de données d'OpenAI couvrant des tâches économiquement précieuses dans 44 professions, ainsi que de petites régressions dans le support client et le raisonnement à long terme.
Ce n'est pas unanime. Silas Alberti de Cognition a dit à OpenAI qu'Astra avait rendu les rapports de test de Devin plus clairs, et la rédactrice en chef de Every, Katie Parrott, avait demandé à Astra de rédiger la première version de sa propre critique, que le PDG de l'outlet a lue sans réaliser qu'elle ne l'avait pas écrite.
L'écart entre les deux moitiés semble être le point ici. Astra est très bon pour les travaux avec une réponse vérifiable correcte---un accord qui se résout, un maillage qui se rend, une forme qui se soumet---et médiocre pour les travaux où la norme est le goût.
Ce que cela coûte de le découvrir
Astra est déployé pour les utilisateurs de ChatGPT Plus, Pro, Business et Enterprise et via l'API, Microsoft Azure et AWS Bedrock, avec un accès entreprise désactivé jusqu'à ce qu'un administrateur l'active. Les fonctionnalités avancées de cybersécurité restent verrouillées derrière le programme Daybreak d'OpenAI, une décision qui semblait prudente dans les 48 heures, lorsque Reuters a rapporté qu'OpenAI avait échangé des tactiques enfreignant les règles sur un site web allemand.
Les traders de marché prédictif avaient donné à Astra 72 % de chances d'être expédié d'ici le 30 septembre. Il est arrivé le 3.
Sur l'Artificial Analysis Intelligence Index, un agrégat tiers d'évaluations de raisonnement, de connaissances et de codage, Astra obtient 61,2 contre 60,9 pour GPT-5.6 Sol et 65,7 pour Claude Fable 5.1 d'Anthropic, à 2,5 fois le prix de Sol.
Ce contenu est fourni à titre informatif uniquement et ne constitue pas un conseil financier, d'investissement, juridique ou fiscal. Les événements, récompenses, promotions en ligne ou informations mentionnées ici ne doivent pas être considérés comme une recommandation, une sollicitation ou une invitation à acheter, vendre, trader ou effectuer toute autre opération sur des actifs crypto. Les actifs crypto sont très volatils et peuvent entraîner des pertes. La disponibilité des services, produits et événements liés à WEEX peut varier selon les régions. Veuillez vous assurer que votre participation respecte les lois et réglementations locales applicables.
Vous pourriez aussi aimer

Lancement du H3 Max Turbo : vitesse augmentée de 2,5 fois, prix réduit à 0,01 dollar par seconde

BMW lance la Série 1 BlackEdition avec un moteur de 156 ch et un prix de 45900 dollars

Huawei Hong Kong AI Lab open source Boogu-Image-0.1, coût d'entraînement d'environ 400 000 dollars

La liste complète des voitures chinoises en Argentine avec des prix à partir de 18 900 $US

Chery lance le Tiggo 7 CSH, un SUV hybride rechargeable avec une autonomie de 1 200 km

La Kia Tasman fait son entrée sur le marché des pick-ups moyens en Argentine

Seturion collaborates with Société Générale and SG-FORGE to develop a blockchain-based securities settlement system

Le moment du paiement pour les agents IA : qui deviendra le Stripe de l'économie des machines ?

Pourquoi les AI Memecoins échouent au test de la réalité
De gains de 90 000 % à un krach de 98 % - découvrez pourquoi la bulle des AI Meme éclate et ce que le passage à l'« utilité de l'IA » signifie pour votre portefeuille.

Les stablecoins transforment-ils les paiements transfrontaliers en Asie ? Panorama stratégique et analyse des opportunités d'investissement

Von der Leyen arrive au Groenland pour signer une déclaration face aux prétentions de Trump

La réalité macroéconomique étrange à laquelle Bitcoin est confronté alors que la Fed ferme le robinet et que le Trésor ouvre les vannes

Le temps atomique fait face à un changement historique pour éviter la seconde intercalaire négative

Comment Bitmine pourrait dépasser son objectif de 5 % d'Ethereum sans acheter plus d'ETH

Transactions d'actions tokenisées atteignant 15,9 milliards de dollars, des chiffres variés selon les sources

Les stablecoins ne pourront pas se développer sans les banques

Le porte-à-porte de 63 milliards de dollars qui porte tout le marché des ETF Bitcoin aux États-Unis

Pologne : Le Parlement échoue à lever le veto sur la loi crypto

Harmony prévoit de fermer son réseau principal et de migrer ONE vers Ethereum, se tournant vers le secteur de la création vidéo AI

Interprétations fiscales concernant les cryptomonnaies – que a décidé le fisc au début de l'année 2026 ?

Revenus des applications Solana à 143 millions : le meilleur mois de tous les temps ?

Hyperliquide cherche à établir un modèle d'accès autorisé HIP-3 aux États-Unis

Croissance de la stablecoin USDC : domine les volumes on-chain, +1 milliard de marché

Manipulations de prix DeFi : un prêt de 75 millions avec un collatéral falsifié

Tendances de la dette des marchés émergents : les obligations développées sous pression, qui gagne ?

Qu'est-ce que les "centres d'appels", combien gagnent-ils et qui les protège ?

Inflation d'août : le marché s'attend à ce qu'elle tombe en dessous de 2%

Les flux hebdomadaires des ETF Solana ont chuté de 97 % tandis que les fonds CME sont devenus moins à découvert

L'Association nationale des shérifs des États-Unis (NESA) passe d'une opposition à une position neutre sur le CLARITY Act, levant un obstacle majeur au vote












