[{"type":"paragraph","text":{"fr":"Tu ouvres Cursor lundi soir pour reprendre ton projet, et dans la liste des modèles, une ligne a changé : Grok 4.7. Pas d'annonce en grande pompe, pas de liste d'attente, le modèle est simplement là, disponible le jour même dans l'éditeur de code, dans l'application Grok, sur X, dans l'API et même dans l'assistant vocal des Tesla. xAI a lancé sa nouvelle version le 21 septembre, 40 jours après Grok 4.6, dont on te racontait mi-août qu'il avait recollé au peloton de tête. La sortie arrive après une série de reports : Elon Musk avait repoussé l'échéance au moins cinq fois depuis fin juillet, passant de « quatre semaines » à « dix jours », puis à un modèle qui avait besoin de « cuire » encore un peu.","en":"You open Cursor on Monday night to get back to your project, and in the model list, one line has changed: Grok 4.7. No grand announcement, no waitlist, the model is simply there, available the same day in the code editor, in the Grok app, on X, in the API and even in Tesla's voice assistant. xAI launched its new version on September 21, 40 days after Grok 4.6, which we told you in mid-August had caught up with the leading pack. The release follows a string of delays: Elon Musk had pushed the deadline back at least five times since late July, going from 'four weeks' to 'ten days', then to a model that needed to 'cook' a little longer."}},{"type":"heading","text":{"fr":"Plus gros, plus têtu, même facture","en":"Bigger, more stubborn, same bill"}},{"type":"paragraph","text":{"fr":"Les chiffres sont simples. Grok 4.7 repose sur un nouveau modèle de base de 2 100 milliards de paramètres, contre 1 500 milliards pour la version précédente, soit 40 % de plus. xAI a allongé la phase d'apprentissage par renforcement en mettant l'accent sur des tâches difficiles qui prennent plusieurs heures, et le modèle revérifie plus souvent ses propres réponses. L'entreprise a aussi ajouté des données internes de SpaceX : télémétrie des satellites Starlink, registres de fabrication, journaux de pannes d'ingénierie. Et le prix ne bouge pas : 2 dollars le million de tokens en entrée, 6 en sortie, avec une variante rapide deux fois plus véloce et deux fois plus chère. Sur le code, les progrès sont nets : 71 % sur DeepSWE, contre 65,2 % pour Grok 4.6.","en":"The numbers are simple. Grok 4.7 runs on a new base model with 2.1 trillion parameters, versus 1.5 trillion for the previous version, 40% more. xAI extended the reinforcement learning phase with an emphasis on hard tasks that take several hours, and the model double-checks its own answers more often. The company also added internal SpaceX data: Starlink satellite telemetry, manufacturing records, engineering failure logs. And the price does not move: 2 dollars per million input tokens, 6 for output, with a fast variant twice as quick and twice as expensive. On code, the progress is clear: 71% on DeepSWE, up from 65.2% for Grok 4.6."}},{"type":"heading","text":{"fr":"Deuxième partout, premier nulle part","en":"Second everywhere, first nowhere"}},{"type":"paragraph","text":{"fr":"C'est là que le tableau se nuance. Sur GDPval, qui mesure la qualité sur des tâches professionnelles réelles, Grok 4.7 obtient 1 695 points, derrière Claude Fable 5.1 d'Anthropic à 1 735. Sur le test d'agent AA-Briefcase, même histoire, 1 657 contre 1 678. Sur CursorBench 4.0, il atteint 46,3 %, loin des 51,8 % de Fable 5.1. Et sur EEBench, un banc d'essai d'ingénierie électrique où les données SpaceX auraient dû faire la différence, il termine deuxième derrière GPT-6 Astra d'OpenAI. Musk lui-même le présente comme à peu près au niveau de Claude Opus 5.0, un modèle qui n'est plus le haut de gamme d'Anthropic. Pour les développeurs qui passent par Cursor ou l'API, l'argument est donc le rapport qualité-prix, pas la couronne. Pour les autres, il reste une question que xAI n'a pas encore réglée : ses nouveaux garde-fous, annoncés comme les plus solides de son histoire, suffiront-ils à éviter les dérapages de modération qui ont collé à Grok ces deux dernières années ? Grok 4.8 est déjà promis, sans date.","en":"That is where the picture gets more nuanced. On GDPval, which measures quality on real professional tasks, Grok 4.7 scores 1,695 points, behind Anthropic's Claude Fable 5.1 at 1,735. On the AA-Briefcase agent test, same story, 1,657 against 1,678. On CursorBench 4.0, it reaches 46.3%, far from Fable 5.1's 51.8%. And on EEBench, an electrical engineering benchmark where the SpaceX data should have made the difference, it finishes second behind OpenAI's GPT-6 Astra. Musk himself describes it as roughly on par with Claude Opus 5.0, a model that is no longer Anthropic's top tier. For developers working through Cursor or the API, the pitch is therefore value for money, not the crown. For everyone else, one question xAI has not settled yet: will its new guardrails, billed as the strongest in its history, be enough to avoid the moderation slip-ups that have stuck to Grok over the past two years? Grok 4.8 is already promised, with no date."}}]