[{"type":"paragraph","text":{"fr":"Tu connais la scène. Tu as collé dans ChatGPT un long document, tu as posé dix questions, corrigé trois fois la même formulation, et au bout d'une heure le modèle te ressort une réponse qui contredit ce que tu lui avais dit au début. Il n'a pas menti : il a oublié. Une conversation avec une IA tient dans une fenêtre de contexte, une quantité fixe de texte que le modèle garde sous les yeux, et quand elle déborde, le début tombe. C'est ce plafond qu'OpenAI vient de faire sauter. GPT-6 Astra, annoncé le jeudi 3 septembre, accepte 1,05 million de tokens d'un coup, de quoi avaler un dépôt de code entier ou des années de mails avant de commencer à perdre le fil. Deux jours plus tôt, Anthropic avait sorti Claude Fable 5.1, dont on te disait qu'il reprenait la tête de la course en faisant grimper l'addition. La réponse d'OpenAI tient en un nom d'étoile, et elle mérite qu'on la lise en entier avant de s'enthousiasmer.","en":"You know the scene. You pasted a long document into ChatGPT, asked ten questions, corrected the same wording three times, and after an hour the model gives you an answer that contradicts what you told it at the start. It did not lie: it forgot. A conversation with an AI lives inside a context window, a fixed amount of text the model keeps in view, and when it overflows, the beginning drops off. That is the ceiling OpenAI has just blown through. GPT-6 Astra, announced on Thursday, September 3, takes 1.05 million tokens at once, enough to swallow an entire code repository or years of emails before losing the thread. Two days earlier, Anthropic had released Claude Fable 5.1, which we told you retook the lead in the race while raising the bill. OpenAI's answer fits in a star's name, and it deserves a full read before getting excited."}},{"type":"heading","text":{"fr":"Un lancement en deux temps, et une gamme qui se simplifie","en":"A two-step launch, and a lineup that gets simpler"}},{"type":"paragraph","text":{"fr":"Le déploiement s'est fait par paliers. Le 3 septembre, seules les organisations inscrites à Daybreak, le programme d'accès contrôlé d'OpenAI centré sur la cybersécurité, ont reçu le modèle. Le 4, les abonnés Business et Pro ont suivi, puis les abonnés Plus à 20 dollars par mois dans la journée (dans Work et Codex seulement, pas dans le sélecteur de modèle du chat), et l'accès API et Amazon Bedrock a été ouvert « dans les jours qui viennent », selon la formule officielle. Dans ChatGPT, le modèle apparaît sous le nom GPT-6, et les formules Pro, Business et Enterprise disposent en plus d'un palier « GPT-6 Astra Pro ». C'est le même modèle, servi avec un mode de raisonnement plus poussé pour les tâches complexes, pas une architecture différente. Pour les entreprises, il est désactivé par défaut et doit être activé espace par espace par un administrateur. Les prix des abonnements, eux, n'ont pas bougé au lancement. Côté API, Astra remplace GPT-5.6 Sol au sommet de la gamme, sous l'identifiant gpt-6-astra. La génération précédente se déclinait en plusieurs variantes, Sol en haut, Terra plus bas à 2 et 12 dollars le million ; la nouvelle s'ouvre avec un seul modèle et un mode Pro. Plus lisible, mais aussi plus cher, on y vient.","en":"The rollout came in stages. On September 3, only organizations enrolled in Daybreak, OpenAI's gated access program focused on cybersecurity, received the model. On the 4th, Business and Pro subscribers followed, then Plus subscribers at $20 a month during the day (in Work and Codex only, not in the chat model picker), with API and Amazon Bedrock access opening 'over the coming days', in the official wording. In ChatGPT, the model shows up as GPT-6, and the Pro, Business and Enterprise plans get an extra 'GPT-6 Astra Pro' tier. It is the same model, served with a deeper reasoning mode for complex tasks, not a different architecture. For businesses, it is off by default and must be enabled workspace by workspace by an admin. Subscription prices did not move at launch. On the API side, Astra replaces GPT-5.6 Sol at the top of the range, under the identifier gpt-6-astra. The previous generation came in several variants, Sol at the top, Terra lower at $2 and $12 per million; the new one opens with a single model and a Pro mode. Clearer, but also pricier, and we are getting to that."}},{"type":"heading","text":{"fr":"Le prix : 10 et 50 dollars, sauf si tu dépasses 272 000 tokens","en":"The price: $10 and $50, unless you cross 272,000 tokens"}},{"type":"paragraph","text":{"fr":"La grille API standard est simple en apparence : 10 dollars par million de tokens en entrée, 50 dollars par million en sortie, 1 dollar pour les entrées déjà en cache. C'est deux fois et demie le tarif promotionnel de GPT-5.6 Sol, à 4 et 20 dollars, qui court jusqu'au 21 novembre. C'est aussi, à la virgule près, le tarif public de Claude Fable 5.1 : les deux leaders se sont alignés. Le piège est ailleurs, et CloudZero l'a bien résumé. Passé 272 000 tokens en entrée, la requête entière, pas seulement l'excédent, est refacturée au double pour l'entrée et le cache, et à une fois et demie pour la sortie, soit 20 et 75 dollars le million. Autrement dit, la fenêtre d'un million de tokens existe, mais l'utiliser coûte deux fois plus cher que ce que la grille affiche. Les modes Batch et Flex divisent la note par deux, le mode rapide la multiplie par deux. Pour toi, abonné Plus, rien de tout ça n'est visible : tu payes 20 dollars et tu consommes ton quota. Pour les développeurs et les entreprises qui bâtissent des produits sur l'API, c'est un changement de modèle économique. Et c'est pour eux que la question « à quoi sert un million de tokens ? » devient une question de budget.","en":"The standard API grid looks simple: $10 per million input tokens, $50 per million output, $1 for cached input. That is two and a half times GPT-5.6 Sol's promotional rate of $4 and $20, which runs until November 21. It is also, to the cent, Claude Fable 5.1's list price: the two leaders have aligned. The trap is elsewhere, and CloudZero summed it up well. Past 272,000 input tokens, the entire request, not just the overflow, is rebilled at double for input and cache, and one and a half times for output, so $20 and $75 per million. In other words, the million-token window exists, but using it costs twice what the grid shows. Batch and Flex modes halve the bill, fast mode doubles it. For you, a Plus subscriber, none of this is visible: you pay $20 and use your allowance. For developers and companies building products on the API, it is a change of economic model. And it is for them that the question 'what is a million tokens for?' becomes a budget question."}},{"type":"image","src":"/images/articles/752-body-1.webp","alt":{"fr":"Le logo OpenAI affiché sur un smartphone posé sur une carte électronique éclairée en bleu","en":"The OpenAI logo displayed on a smartphone resting on a blue-lit circuit board"},"credit":"Reuters via Al Jazeera"},{"type":"heading","text":{"fr":"Le raisonnement en boucle, ou pourquoi tu ne verras plus le modèle réfléchir","en":"Looped reasoning, or why you will no longer see the model think"}},{"type":"paragraph","text":{"fr":"Sous le capot, Astra introduit ce qu'OpenAI appelle la « profondeur récurrente », une architecture de transformeurs en boucle : au lieu d'écrire son raisonnement étape par étape en texte, le modèle repasse plusieurs fois sur ses propres calculs internes avant de répondre. Gain : de l'efficacité, et une vitesse mesurable, presque deux fois plus rapide sur les tâches d'usage d'ordinateur, 47 % de temps en moins sur le banc OSWorld 2.0, 40 minutes par tâche contre 75 pour Sol. Contrepartie, notée jusque sur la page Wikipedia du modèle : une partie ou la totalité de la « chaîne de pensée », ce fil de raisonnement que les chercheurs en sûreté lisaient pour comprendre les décisions d'une IA, devient invisible. Des voix s'inquiètent de la capacité à surveiller un modèle qu'on ne peut plus lire. OpenAI répond par ses propres chiffres : un taux de comportements mal alignés de 3,4 % contre 18,8 % pour Sol, un taux d'hallucination de 4,2 %, et le titre, revendiqué dans le communiqué, de modèle le plus aligné jamais publié. L'entraînement a mobilisé plus de 100 000 GPU sur le site Stargate au Texas, la plus grosse session de l'histoire de l'entreprise, et la date de coupure des connaissances est fixée au 30 avril 2026. Dans Codex, l'outil de programmation, une nouveauté parle directement au problème de l'oubli : au lieu de compresser la conversation quand elle déborde, l'agent garde des notes consultables d'une fenêtre à l'autre.","en":"Under the hood, Astra introduces what OpenAI calls 'recurrent depth', a looped transformer architecture: instead of writing out its reasoning step by step as text, the model runs over its own internal computations several times before answering. The gain: efficiency, and measurable speed, nearly twice as fast on computer-use tasks, 47% less time on the OSWorld 2.0 benchmark, 40 minutes per task against 75 for Sol. The trade-off, noted right down to the model's Wikipedia page: part or all of the 'chain of thought', the reasoning trail safety researchers used to read to understand an AI's decisions, becomes invisible. Some worry about the ability to monitor a model you can no longer read. OpenAI answers with its own numbers: a misaligned-outcome rate of 3.4% against 18.8% for Sol, a hallucination rate of 4.2%, and the claim, made in the announcement, of the most aligned model it has ever released. Training mobilized more than 100,000 GPUs at the Stargate site in Texas, the largest run in the company's history, and the knowledge cutoff is April 30, 2026. In Codex, the coding tool, one new feature speaks directly to the forgetting problem: instead of compacting the conversation when it overflows, the agent keeps searchable notes from one window to the next."}},{"type":"quote","text":{"fr":"Le modèle le plus intelligent et le plus aligné au monde.","en":"The most intelligent and aligned model in the world."},"author":"OpenAI, communiqué de lancement de GPT-6 Astra, 3 septembre 2026"},{"type":"heading","text":{"fr":"Le seuil « critique » en cybersécurité, et la version qui dit non","en":"The 'critical' cybersecurity threshold, and the version that says no"}},{"type":"paragraph","text":{"fr":"C'est le point le plus inhabituel de ce lancement. OpenAI classe ses modèles selon un cadre interne, le Preparedness Framework, et Astra est le premier à atteindre le palier « critique » en cybersécurité, avec un score de 100 % sur ExploitBench, un banc qui mesure la capacité à écrire des attaques informatiques. Conséquence : les capacités de création d'exploits sont réservées aux organisations validées dans Daybreak, et la version que toi et moi utilisons refuse certaines questions dans ce domaine. Une variante défensive, GPT-5.4-Cyber, existe en parallèle pour les équipes de sécurité. On peut y voir de la prudence ou du marketing, mais le fait est là : pour la première fois, un modèle grand public est vendu avec une partie de ses capacités volontairement retirée. Greg Brockman, le président d'OpenAI, a parlé d'un « saut générationnel » et suggéré qu'on pourrait, avec le recul, voir dans Astra l'arrivée d'une intelligence artificielle générale. Sur les bancs d'essai, les chiffres publiés par OpenAI sont spectaculaires : 97,6 % sur FrontierMath niveau 4, où l'on te racontait en août qu'un prototype d'Astra avait résolu dix problèmes ouverts, 99,9 % sur ARC-AGI-3 (avec un harnais maison qui fait débat chez les évaluateurs indépendants), 96 % sur GPQA Diamond. Face à Claude Fable 5.1, DataCamp relève qu'Astra domine en mathématiques (97,6 contre 87,8 sur FrontierMath) mais que Fable garde l'avantage sur Humanity's Last Exam, 65 contre 57,2. Deux modèles au même prix, deux profils différents.","en":"This is the most unusual point of the launch. OpenAI classifies its models under an internal framework, the Preparedness Framework, and Astra is the first to reach the 'critical' tier in cybersecurity, with a 100% score on ExploitBench, a benchmark measuring the ability to write computer attacks. Consequence: exploit-creation capabilities are reserved for organizations vetted through Daybreak, and the version you and I use refuses certain questions in that area. A defensive variant, GPT-5.4-Cyber, exists alongside it for security teams. You can read this as caution or as marketing, but the fact stands: for the first time, a consumer model is sold with part of its capabilities deliberately removed. Greg Brockman, OpenAI's president, spoke of a 'generational leap' and suggested that, in hindsight, Astra might be seen as the arrival of artificial general intelligence. On the benchmarks, the numbers OpenAI published are spectacular: 97.6% on FrontierMath Tier 4, where we told you in August that an Astra prototype had solved ten open problems, 99.9% on ARC-AGI-3 (with an in-house harness that independent evaluators are debating), 96% on GPQA Diamond. Against Claude Fable 5.1, DataCamp notes that Astra dominates in mathematics (97.6 versus 87.8 on FrontierMath) but that Fable keeps the edge on Humanity's Last Exam, 65 against 57.2. Two models at the same price, two different profiles."}},{"type":"paragraph","text":{"fr":"Concrètement, qu'est-ce que ça fait de plus ? OpenAI a montré Astra en train de remplir une déclaration d'impôts, de construire une scène de jeu vidéo, de commander un repas et de chercher un emploi, des tâches où le modèle pilote lui-même un navigateur ou un ordinateur plutôt que de répondre à une question. Sur DeepSWE, un banc de programmation qui mesure la résolution de vrais tickets, il atteint 74,1 % ; sur Terminal-Bench 4.0, 57,7 %, là où Gemini 3.8 Flash plafonne à 19,1 %. Dans Codex, OpenAI mesure des tâches bouclées 1,9 fois plus vite qu'avec Sol sur Mind2Web, et la version Sol elle-même a reçu au passage une optimisation de son harnais qui la rend environ 60 % plus rapide. Le message est clair : la génération 6 n'est pas vendue comme un meilleur chatbot, mais comme un agent qui travaille à ta place, plus longtemps, sur des dossiers plus gros.","en":"Concretely, what does it do more? OpenAI showed Astra filling out a tax return, building a video game scene, ordering a meal and searching for a job, tasks where the model itself drives a browser or a computer rather than answering a question. On DeepSWE, a coding benchmark measuring the resolution of real tickets, it reaches 74.1%; on Terminal-Bench 4.0, 57.7%, where Gemini 3.8 Flash tops out at 19.1%. In Codex, OpenAI measures tasks completed 1.9 times faster than with Sol on Mind2Web, and the Sol version itself received a harness optimization along the way that makes it roughly 60% faster. The message is clear: generation 6 is not sold as a better chatbot, but as an agent that works in your place, for longer, on bigger files."}},{"type":"heading","text":{"fr":"À qui ça sert vraiment","en":"Who this is really for"}},{"type":"paragraph","text":{"fr":"Soyons honnêtes sur l'usage quotidien. Si tu demandes à ChatGPT de reformuler un mail ou de résumer un article, tu ne verras pas la différence entre Sol et Astra, et le million de tokens te sera aussi utile qu'un camion pour aller chercher le pain. Le gain réel concerne trois profils. Ceux qui travaillent sur de très longs documents, contrats, thèses, dossiers médicaux, et qui pourront enfin poser toutes leurs questions dans une seule conversation sans que le début s'efface. Les développeurs, pour qui un dépôt entier en mémoire et un agent qui ne perd plus ses notes changent la manière de coder. Et les entreprises qui automatisent des tâches sur ordinateur, où la vitesse doublée se traduit directement en coûts. Pour tous les autres, la vraie nouveauté est ailleurs : depuis juillet et l'offensive GPT-5.6 puis GPT-Live, OpenAI sort un modèle majeur tous les deux mois, Anthropic lui répond dans la semaine, et Google suit avec ses Gemini. Le rythme est devenu tel que l'outil que tu utilises ce matin sera dépassé avant Noël, et que la question intéressante n'est plus « lequel est le meilleur ? » mais « lequel accepte encore de te montrer comment il réfléchit ? ». Astra a choisi de ne plus le faire. C'est peut-être le vrai tournant de cette génération.","en":"Let us be honest about everyday use. If you ask ChatGPT to rephrase an email or summarize an article, you will not see the difference between Sol and Astra, and the million tokens will be as useful to you as a truck to fetch bread. The real gain concerns three profiles. People who work on very long documents, contracts, theses, medical files, who will finally be able to ask all their questions in a single conversation without the beginning fading away. Developers, for whom an entire repository in memory and an agent that no longer loses its notes change the way they code. And companies automating computer tasks, where doubled speed translates directly into costs. For everyone else, the real news is elsewhere: since July and the GPT-5.6 then GPT-Live offensive, OpenAI ships a major model every two months, Anthropic answers within the week, and Google follows with its Geminis. The pace is such that the tool you use this morning will be outdated before Christmas, and the interesting question is no longer 'which one is best?' but 'which one still agrees to show you how it thinks?'. Astra has chosen to stop doing so. That may be the real turning point of this generation."}}]