GPT-6 Astra : ce qu'OpenAI a sorti, prix et benchmarks
OpenAI a annoncé GPT-6 Astra le 3 septembre 2026, en le présentant comme son modèle le plus intelligent et le mieux aligné. Il embarque une fenêtre de contexte de 1 050 000 tokens, jusqu'à 128 000 tokens en sortie, coûte 10 dollars par million de tokens en entrée et 50 en sortie, et ajoute cinq niveaux d'effort de raisonnement pensés pour les tâches agentiques longues. L'accès est parti des entreprises du Trusted Access Program, puis de l'API et de ChatGPT Plus, Pro, Business et Enterprise. Sources : OpenAI, CNBC, Al Jazeera, OpenRouter.
Le contexte
OpenAI a annoncé GPT-6 Astra le 3 septembre 2026, et le cadrage était aussi notable que le modèle. L’entreprise l’a qualifié de système « le plus intelligent et le mieux aligné du monde », puis a consacré une part inhabituelle de son annonce à ce qui pouvait mal tourner avec. C’est un changement de registre pour un lancement phare, et il vaut la peine d’être compris avant les spécifications.
Les spécifications sont, il est vrai, imposantes. Astra lit jusqu’à 1 050 000 tokens par requête et en réécrit jusqu’à 128 000. Il coûte 10 dollars par million de tokens en entrée et 50 dollars par million en sortie, avec les préfixes de prompt en cache à 1 dollar le million, et c’est ce dernier chiffre qui décide si une charge agentique est soutenable. Il embarque cinq niveaux d’effort de raisonnement, ce qui permet de faire tourner le même modèle en mode rapide et économique ou en mode lent et minutieux.
Côté benchmarks, OpenAI annonce 99,9 % sur ARC-AGI-3, 97,6 % sur FrontierMath Tier 4, 72,6 % sur OSWorld 2.0 et 100 % sur ExploitBench, devant GPT-5.6 Sol et le Claude Fable 5 d’Anthropic. Le résultat qui compte vraiment au quotidien est plus discret : 96,3 % sur MRCR v2, le test de récupération en contexte long, contre 73,8 % pour GPT-5.6 Sol. Une fenêtre d’un million de tokens ne vaut son prix que si le modèle y retrouve ce qu’il cherche, et cet écart sépare un chiffre marketing d’un chiffre utilisable.
Le déploiement a été échelonné plutôt qu’ouvert. Les entreprises retenues dans le Trusted Access Program, bâti autour des travaux de cybersécurité, ont reçu Astra les premières. L’accès API et la disponibilité dans ChatGPT Plus, Pro, Business et Enterprise ont suivi dans les jours d’après, avec une distribution via Amazon Web Services. Ce séquençage est l’argument de sécurité en pratique : un modèle qui obtient 100 % à un test de recherche de vulnérabilités excelle exactement là où défenseurs et attaquants veulent tous les deux exceller, et OpenAI a choisi de le confier d’abord à des défenseurs identifiés.
Pour qui hésite à basculer, la bonne question n’est pas quel modèle est le meilleur mais quelles tâches justifient le prix. Les prompts courts aux sorties simples tournent très bien, et bien moins cher, sur des modèles plus anciens. Les cas où Astra mérite son coût sont les longs : agents enchaînant de nombreuses étapes sans supervision, corpus documentaires massifs, code qu’il faut lire avant d’écrire. Router par tâche vaut mieux que migrer en bloc. Sources : OpenAI, CNBC, Al Jazeera, OpenRouter, llm-stats.
Questions fréquentes
Vrai ou faux ?
1 050 000 tokens en entrée, un peu au-dessus du chiffre rond que tout le monde cite, avec une sortie plafonnée à 128 000. (OpenRouter)
Non. Les entreprises filtrées du Trusted Access Program sont passées en premier, ChatGPT et l'API ont suivi les jours d'après. (CNBC)
Sur les benchmarks d'OpenAI, oui. Ce sont les tests de l'éditeur choisis par l'éditeur : à considérer comme une affirmation en attente de réplication indépendante. (Al Jazeera)
10 dollars le million en entrée et 50 en sortie le placent dans le haut du panier. La seule vraie remise est à 1 dollar le million sur les préfixes en cache. (OpenRouter)
100 % sur ExploitBench, ce qui explique précisément pourquoi l'annonce a tant parlé de mésusage. (OpenAI)
L'écart en contexte long tranche : 96,3 % sur MRCR v2 contre 73,8 % pour GPT-5.6 Sol, c'est un autre modèle, pas un changement d'étiquette. (OpenAI)
Un abonnement ChatGPT Plus y donne accès, l'API ordinaire aussi. Le Trusted Access Program ne réglait que l'ordre d'arrivée. (CNBC)