Grok 4.7 : xAI grossit son modèle de 40 % sans toucher au prix
2 100 milliards de paramètres, 2 dollars le million de tokens en entrée, 6 en sortie. Grok 4.7 progresse nettement, mais reste derrière Claude Fable 5.1 et GPT-6 Astra sur plusieurs benchmarks.
Par Tom Valois, le 22 septembre 2026. Catégorie : Tech & IA.
Tu ouvres Cursor lundi soir pour reprendre ton projet, et dans la liste des modèles, une ligne a changé : Grok 4.7. Pas d'annonce en grande pompe, pas de liste d'attente, le modèle est simplement là, disponible le jour même dans l'éditeur de code, dans l'application Grok, sur X, dans l'API et même dans l'assistant vocal des Tesla. xAI a lancé sa nouvelle version le 21 septembre, 40 jours après Grok 4.6, dont on te racontait mi-août qu'il avait recollé au peloton de tête. La sortie arrive après une série de reports : Elon Musk avait repoussé l'échéance au moins cinq fois depuis fin juillet, passant de « quatre semaines » à « dix jours », puis à un modèle qui avait besoin de « cuire » encore un peu.
Plus gros, plus têtu, même facture
Les chiffres sont simples. Grok 4.7 repose sur un nouveau modèle de base de 2 100 milliards de paramètres, contre 1 500 milliards pour la version précédente, soit 40 % de plus. xAI a allongé la phase d'apprentissage par renforcement en mettant l'accent sur des tâches difficiles qui prennent plusieurs heures, et le modèle revérifie plus souvent ses propres réponses. L'entreprise a aussi ajouté des données internes de SpaceX : télémétrie des satellites Starlink, registres de fabrication, journaux de pannes d'ingénierie. Et le prix ne bouge pas : 2 dollars le million de tokens en entrée, 6 en sortie, avec une variante rapide deux fois plus véloce et deux fois plus chère. Sur le code, les progrès sont nets : 71 % sur DeepSWE, contre 65,2 % pour Grok 4.6.
Deuxième partout, premier nulle part
C'est là que le tableau se nuance. Sur GDPval, qui mesure la qualité sur des tâches professionnelles réelles, Grok 4.7 obtient 1 695 points, derrière Claude Fable 5.1 d'Anthropic à 1 735. Sur le test d'agent AA-Briefcase, même histoire, 1 657 contre 1 678. Sur CursorBench 4.0, il atteint 46,3 %, loin des 51,8 % de Fable 5.1. Et sur EEBench, un banc d'essai d'ingénierie électrique où les données SpaceX auraient dû faire la différence, il termine deuxième derrière GPT-6 Astra d'OpenAI. Musk lui-même le présente comme à peu près au niveau de Claude Opus 5.0, un modèle qui n'est plus le haut de gamme d'Anthropic. Pour les développeurs qui passent par Cursor ou l'API, l'argument est donc le rapport qualité-prix, pas la couronne. Pour les autres, il reste une question que xAI n'a pas encore réglée : ses nouveaux garde-fous, annoncés comme les plus solides de son histoire, suffiront-ils à éviter les dérapages de modération qui ont collé à Grok ces deux dernières années ? Grok 4.8 est déjà promis, sans date.
À lire aussi en Tech & IA
- Meta Connect 2026 : lunettes sans caméra, casque Phoenix, ce qu'on attend de la keynote
- iPhone 18 Pro : les premiers tests sont tombés, et le verdict tient en un mot, « incrémental »
- iOS 27 est là, le nouveau Siri aussi, mais pas encore en français
- OpenAI ouvre sa voix aux développeurs : GPT-Live-1 à 5 centimes la minute
Les derniers articles CTRL-POP
- Control Resonant : 84 sur Metacritic, Remedy signe une suite plus folle et plus clivante
- Tokyo Game Show 2026 : le typhon Dujuan ampute le salon de son dernier jour
- Resident Evil : 60 millions de dollars, Zach Cregger pulvérise le record de la saga
- Shin Oishinbo : le manga culte de la gastronomie revient en anime, 35 ans après
Tous les articles · Toutes les thématiques · L'équipe CTRL-POP