Grok 4.6 : xAI recolle au peloton de tête, 35 jours après Grok 4.5
Lancé le 12 août, Grok 4.6 égale GPT-5.6 sur l'index Artificial Analysis à prix constant, avec 500K de contexte et une efficacité d'agent doublée. La course aux modèles ne laisse plus respirer personne.
Par Tom Valois, le 16 août 2026. Catégorie : Tech & IA.
Tu avais à peine fini de digérer les benchmarks de Grok 4.5 que xAI remettait déjà une pièce dans la machine. Trente-cinq jours. C'est le temps qu'il aura fallu à l'équipe d'Elon Musk pour sortir Grok 4.6, dévoilé le 12 août. Un rythme qui en dit long sur l'état de la course à l'IA en 2026 : plus personne ne s'autorise un trimestre de silence, sous peine de disparaître des conversations.
61 points, à un souffle du sommet
Sur l'Artificial Analysis Intelligence Index, l'agrégateur de benchmarks qui sert de thermomètre officieux au secteur, Grok 4.6 décroche un score de 61. Soit une égalité avec GPT-5.6 d'OpenAI, dont on décryptait l'offensive éclair en juillet, et un seul petit point derrière le leader actuel, le dernier modèle d'Anthropic. Autrement dit : les trois géants américains tiennent dans un mouchoir de poche. Le tout sans toucher aux tarifs, maintenus à 2 dollars le million de tokens en entrée et 6 dollars en sortie, avec une fenêtre de contexte portée à 500 000 tokens et un nouveau mode de raisonnement « xhigh » pour les tâches les plus lourdes.
Moitié moins de tours pour faire le travail
Le vrai argument de vente de cette version ne se lit pourtant pas dans le score brut. xAI annonce que Grok 4.6 boucle les tâches d'agent en moitié moins de tours que son prédécesseur. Concrètement : quand tu demandes au modèle d'enchaîner des actions, chercher, coder, corriger, vérifier, il a besoin de deux fois moins d'allers-retours pour arriver au résultat. Pour les développeurs qui paient au token, c'est une division de la facture. Pour les usages agentiques qui explosent depuis un an, c'est l'écart qui compte davantage que trois points de benchmark. C'est aussi un changement de ton pour xAI, qu'on avait plutôt vu jouer sur le terrain du spectaculaire avec le clonage vocal de Grok 4.3.
Reste la question que tout le monde se pose : combien de temps ce classement tiendra-t-il ? Trente-cinq jours entre deux flagships xAI, des mises à jour OpenAI toutes les six semaines, Anthropic qui avance à son propre rythme : le podium change désormais de tête plusieurs fois par saison. Le prochain point de bascule est déjà identifié : les modèles de fin d'année, traditionnellement les plus gros lancements du secteur. D'ici là, Grok 4.6 est disponible via l'API xAI et l'abonnement X Premium. Si tu utilises des agents au quotidien, c'est le moment de comparer ta facture.