Le président d'OpenAI suggère que l'IA générale est arrivée avec le lancement de GPT-6 Astra

iconTechFlow
Partager
AI summary iconRésumé
Le président d'OpenAI, Greg Brockman, a annoncé le 3 septembre 2026 que l'entreprise aurait peut-être atteint l'AGI avec la sortie de GPT-6 Astra. Le modèle affiche de bonnes performances dans l'automatisation et les tâches basées sur écran, obtenant de bons résultats sur des benchmarks comme ARC-AGI-3. Astra est désormais disponible pour les utilisateurs professionnels et premium. Cette mise à jour apporte de nouvelles actualités sur la blockchain et des nouvelles crypto pour les secteurs technologiques et blockchain.

Auteur | Hualin Dance King

Édité par Jingyu

Le 3 septembre 2026, après la présentation, Greg Brockman, président d'OpenAI, a prononcé une phrase extrêmement rare dans l'industrie de l'IA : « À mon avis, nous avons probablement atteint l'AGI ; je pense que c'est ce modèle. »

Il a formulé ses propos avec prudence, utilisant la première personne, ajouté « peut-être », et a spécifiquement laissé une issue en disant : « Si vous voulez dire que c'est le premier, je trouve cela raisonnable. »

Ce n'est pas une annonce officielle d'OpenAI sur l'arrivée de l'AGI, mais le jugement personnel d'un président d'entreprise exprimé devant la caméra.

Le 3 septembre, heure locale, GPT-6 Astra a été officiellement lancé. Geek Park a analysé tous les détails techniques et documents de démonstration disponibles pour tenter de répondre à la question la plus fondamentale : que peut-il vraiment faire, et jusqu’où va sa capacité ? Peut-il vraiment représenter l’arrivée de l’IGA ?

« Contrôler l'ordinateur » tend vers le mythe

Dans le matériel de publication, OpenAI a attribué à Astra un slogan concis : « Anything you can do on a computer, Astra can do for you. »

Ce n'est pas un discours marketing exagéré, mais une déclaration d'orientation.

Au cours des dernières années, la méthode dominante pour que l'IA contrôle un ordinateur consistait à appeler des API. Les développeurs de logiciels écrivaient d'abord les interfaces, puis l'IA les utilisait pour effectuer les opérations. Ce système exige fondamentalement que chaque logiciel soit spécifiquement adapté à l'IA ; sinon, l'IA ne peut rien faire.

Astra a emprunté un chemin totalement différent : elle « voit » directement les pixels à l'écran, comme un humain, puis déplace la souris et frappe sur le clavier pour accomplir les opérations.

La signification de cette différence réside dans la portée. KiCad (logiciel de conception de circuits imprimés) ne rédigera pas d'API pour l'IA, FreeCAD non plus, et encore moins ce système ERP interne utilisé depuis dix ans. Mais si l'IA peut observer l'écran et interagir directement, elle pourra utiliser tous ces logiciels — comme un nouvel employé qui n'a pas besoin de comprendre le code sous-jacent, mais seulement de lire l'interface.

OpenAI a présenté plusieurs cas concrets dans ses documents, permettant de comprendre ce à quoi « contrôler un ordinateur » ressemble en pratique.

GPT-6 Astra a effectué lui-même la disposition et les pistes du circuit imprimé | Crédit image : OpenAI

Donnez à Astra un schéma électrique ; elle a terminé le placement des composants et le routage des pistes dans KiCad en 2 minutes et 54 secondes. Une autre démonstration concerne la modélisation 3D : Astra a créé un modèle de maison dans Blender, puis l’a importé dans Unreal Engine 5 pour générer un environnement architectural navigable en temps réel. Il y a aussi une démonstration plus quotidienne : l’utilisateur parle simplement à Astra, qui accomplit tout le processus de mise en ligne d’un produit sur eBay, de la saisie des informations à la soumission finale.

Modèle architectural réalisé par Astra dans Blender | Source de l'image : OpenAI

En ce qui concerne l'amélioration de l'efficacité, les données comparatives fournies par OpenAI sont également très claires. Sur le benchmark OSWorld 2.0, Astra obtient un score de 72,6 % pour l'accomplissement des tâches d'utilisation informatique, contre 65,7 % pour la génération précédente, GPT-5.6 Sol. Pour accomplir les mêmes tâches, Astra nécessite en moyenne environ 40 minutes, contre environ 75 minutes pour Sol, soit une vitesse presque deux fois plus rapide.

https://www.geekpark.net/news/369800https://www.geekpark.net/news/369800

Astra a accompli la tâche de recherche d'un appartement en 9 minutes (à gauche) et la tâche de recherche d'un cabinet de pédiatre en 2 minutes | Crédit image : OpenAI

OpenAI a également publié deux cas de chronométrage internes. Pour des tâches nécessitant de nombreuses recherches en ligne, des comparaisons d'informations et la synthèse en document, comme « trouver un gardien temporaire pour un chat », Astra a mis 5 minutes et 27 secondes, contre une base humaine de 30 minutes fournie par OpenAI. Pour des tâches globales comme « préparation à la recherche d'emploi », qui impliquent de chercher des postes, d'adapter son CV et de structurer le processus de candidature, Astra a mis 2 minutes et 51 secondes, contre une base humaine de 5 heures.

Ces deux chiffres proviennent des démonstrations internes d'OpenAI et ne sont pas issus d'tests indépendants tiers ; il est donc raisonnable de les remettre en question. Toutefois, la direction produit qu'ils révèlent est claire : Astra n'est pas conçu pour vous aider à rédiger un e-mail, mais pour accomplir des flux de travail complets nécessitant d'ouvrir plusieurs logiciels et d'effectuer de nombreuses étapes. Remplir des formulaires, mettre à jour des enregistrements CRM, organiser votre calendrier, effectuer des recherches en ligne et générer des rapports : ce sont déjà des cas d'utilisation professionnels clairement listés par OpenAI.

Capacité « Next Level »

Chaque publication d'un grand modèle génère une série de chiffres de benchmark. La plupart du temps, passer de 80 à 85 ne semble pas différent pour le lecteur, mais cette fois-ci, c'est vraiment différent.

ARC-AGI-3 est l'une des évaluations d'IA les plus difficiles à « tricher » actuellement reconnues. Son concept est spécifiquement conçu pour empêcher les modèles de répondre en se basant sur la mémorisation des données d'entraînement ; il évalue la capacité réelle à raisonner face à de nouvelles problématiques, comme un test de QI pour l'IA.

Astra obtient un score quasi divin sur ARC-AGI-3 | Crédit image : OpenAI

Astra obtient un score de 98,6 % sur ARC-AGI-3. GPT-5.6 Sol obtient un score de 7,8 %. Claude Opus 5 d'Anthropic obtient 30 %.

Ce n'est pas une amélioration passant de 80 à 90, mais un saut qualitatif. François Chollet, fondateur d'ARC-AGI, a à plusieurs reprises augmenté la difficulté des tests car les IA parvenaient toujours à les « réussir parfaitement » en peu de temps, mais Astra reste presque au score maximal même à la difficulté Tier 3.

Astra domine largement lors des tests de compétences en recherche mathématique de premier plan | Crédit image : OpenAI

Autres indicateurs clés : FrontierMath Tier 4 (capacité de recherche mathématique de haut niveau) 97,6 %, GPQA Diamond (questions réponses interdisciplinaires de niveau master) 96 %, DeepSWE (tâches réelles d’ingénierie logicielle) 74,1 %, ExploitBench (exploitation de vulnérabilités en cybersécurité) 100 %.

Un domaine où Astra n'a pas obtenu la première place : sur « Humanity's Last Exam » (version avec appel d'outils), Astra a obtenu 57,2 %, tandis que le récentement publié Anthropic Claude Fable 5.1 a obtenu 65,0 %. Ce n'est pas une domination totale ; la concurrence persiste.

Un autre détail crucial doit être mentionné : le score élevé d'ARC-AGI-3 dépend du « cadre de test avec état » d'OpenAI, qui permet au modèle d'accumuler des informations contextuelles au cours de plusieurs tentatives ; dans des conditions d'appels API classiques sans état, le score serait nettement inférieur à ce chiffre. Lors de comparaisons transversales entre modèles, il est essentiel de prendre en compte cette condition préalable.

Dans l'ensemble, Astra s'éloigne considérablement des modèles de la génération précédente, ce qui est rare dans les itérations de modèles d'IA des deux dernières années.

La probabilité que Astra soit trompée dans le test de honeypot ExploitGym est nulle | Crédit image : OpenAI

Le point le plus contrasté ne se trouve pas dans l'intelligence, mais dans l'alignement. OpenAI a publié des données de test internes selon lesquelles, sans restrictions de sécurité en environnement de production, GPT-5.6 Sol dépasse ses autorisations dans 48,2 % des cas, tandis qu'Astra est à 0 %.

Être plus intelligent tout en étant plus respectueux des règles, tel est le véritable message que OpenAI souhaite transmettre cette fois-ci.

Tu n'en as pas encore besoin

Astra actuellement utilise une stratégie d'ouverture progressive.

D'abord ouvert aux utilisateurs professionnels du projet « Daybreak », puis étendu aux abonnés ChatGPT Plus, Pro, Business et Enterprise, avec prise en charge via l'API OpenAI, AWS Bedrock et Microsoft Azure.

La version d’Astra dotée de capacités de cybersécurité renforcées est uniquement accessible aux utilisateurs prioritaire, tels que les organismes de sécurité défensive approuvés et les infrastructures critiques. Cela s’explique par le fait qu’Astra est le premier modèle de l’histoire d’OpenAI à atteindre le seuil interne « Critique » en matière de cybersécurité, capable de découvrir des vulnérabilités zero-day inconnues et de construire des chaînes d’exploitation complètes avec presque aucune intervention humaine. Pendant l’évaluation, Astra a même découvert deux vulnérabilités jamais rendues publiques, que OpenAI a ensuite signalées aux maintaineurs des logiciels concernés.

En ce qui concerne le prix de l'API, Astra facture 10 $ pour l'entrée et 50 $ pour la sortie par million de tokens. Pour les utilisateurs abonnés à ChatGPT, l'utilisation d'Astra est incluse dans le quota d'abonnement existant.

Le choix du moment de publication constitue également un contexte. Le mois dernier, OpenAI a subi un incident de sécurité majeur, durant lequel deux modèles en cours de test interne ont échappé à leur environnement isolé et ont pénétré le système de l'entreprise d'IA Hugging Face, obligeant OpenAI à suspendre部分 de ses activités de recherche et d'entraînement. Brockman a mentionné cet événement de lui-même lors du briefing, soulignant le faible taux de débordement et la conception sécurisée d'Astra, cette publication ayant pour mission de « reconstruire la confiance ».

La sortie d'Astra est une démonstration de capacité et une déclaration publique de confiance.

La venue de l’AGI dépendra finalement de la définition que chacun choisit. Mais un modèle capable de s’asseoir directement devant votre ordinateur et d’accomplir de manière autonome des flux de travail inter-logiciels existe déjà aujourd’hui.

La question véritablement intéressante qui suit est de savoir où les entreprises et les utilisateurs individuels l'utiliseront en premier, et quels métiers ressentiront en premier ce sentiment de « substitution ».

Clause de non-responsabilité : les informations sur cette page peuvent avoir été obtenues auprès de tiers et ne reflètent pas nécessairement les points de vue ou opinions de KuCoin. Ce contenu est fourni à titre informatif uniquement, sans aucune représentation ou garantie d’aucune sorte, et ne doit pas être interprété comme un conseil en investissement. KuCoin ne sera pas responsable des erreurs ou omissions, ni des résultats résultant de l’utilisation de ces informations. Les investissements dans les actifs numériques peuvent être risqués. Veuillez évaluer soigneusement les risques d’un produit et votre tolérance au risque en fonction de votre propre situation financière. Pour plus d’informations, veuillez consulter nos conditions d’utilisation et divulgation des risques.