[{"type":"paragraph","text":{"fr":"Tu ouvres ton classement de benchmarks le matin, par réflexe, comme d'autres regardent les résultats de Ligue 1. En haut du Frontend Code Arena, un nom que tu n'attendais pas là : Kimi K3. Pas GPT, pas Claude, pas Gemini. Un modèle publié par Moonshot AI, société pékinoise fondée en 2023, qui devance Claude Fable 5 et GPT-5.6 Sol sur ce classement précis. Et qui, à partir du 27 juillet, doit devenir téléchargeable par n'importe qui.","en":"You open your benchmark leaderboard in the morning, out of habit, the way others check football results. At the top of the Frontend Code Arena, a name you did not expect there: Kimi K3. Not GPT, not Claude, not Gemini. A model published by Moonshot AI, a Beijing company founded in 2023, ahead of Claude Fable 5 and GPT-5.6 Sol on that specific leaderboard. And which, from July 27, is due to become downloadable by anyone."}},{"type":"heading","text":{"fr":"2 800 milliards de paramètres, mais pas tous en même temps","en":"2.8 trillion parameters, but not all at once"}},{"type":"paragraph","text":{"fr":"Le chiffre qui circule, 2 800 milliards de paramètres, mérite une explication parce qu'il est trompeur si on le lit comme une puissance brute. Kimi K3 est un modèle dit « mixture of experts » : il contient 896 sous-modèles spécialisés, mais n'en active que 16 pour traiter chaque bout de texte. C'est un peu comme une rédaction de 896 journalistes où seuls 16 écrivent chaque article, choisis selon le sujet. Résultat, le modèle a la culture générale d'un géant et le coût de fonctionnement d'un modèle beaucoup plus modeste. Moonshot revendique environ 2,5 fois plus d'efficacité que sur son précédent modèle K2.","en":"The figure going around, 2.8 trillion parameters, needs explaining because it is misleading if you read it as raw power. Kimi K3 is a 'mixture of experts' model: it contains 896 specialized sub-models, but only activates 16 of them to process each chunk of text. Think of a newsroom of 896 journalists where only 16 write each article, picked by topic. The result is a model with the general knowledge of a giant and the running cost of a far more modest one. Moonshot claims roughly 2.5 times better efficiency than its previous K2 model."}},{"type":"paragraph","text":{"fr":"Sur les classements, K3 est premier au Frontend Code Arena avec 1 679 points, devant Claude Fable 5 à 1 631 et GPT-5.6 Sol à 1 618. Sur l'Artificial Analysis Intelligence Index, qui mesure un spectre bien plus large de compétences, il se place troisième. Autrement dit : excellent sur le code d'interface, très bon partout ailleurs, pas encore devant sur le raisonnement général. La nuance compte, parce que les classements uniques font vite dire n'importe quoi.","en":"On the leaderboards, K3 is first on the Frontend Code Arena with 1,679 points, ahead of Claude Fable 5 at 1,631 and GPT-5.6 Sol at 1,618. On the Artificial Analysis Intelligence Index, which measures a far broader spread of skills, it lands third. In other words: excellent at interface code, very good everywhere else, not yet ahead on general reasoning. The nuance matters, because single leaderboards make people say anything."}},{"type":"heading","text":{"fr":"« Ouvrir les poids », ça veut dire quoi concrètement","en":"What 'opening the weights' actually means"}},{"type":"paragraph","text":{"fr":"Les poids d'un modèle, ce sont les milliards de valeurs numériques apprises pendant l'entraînement. C'est le modèle lui-même, pas son code source. Quand une entreprise les publie, n'importe qui peut télécharger le fichier, le faire tourner sur ses propres machines, l'adapter à son métier, l'auditer. Un hôpital, un cabinet d'avocats ou une administration peuvent l'utiliser sans qu'une seule ligne de leurs données ne sorte de leurs serveurs. C'est très exactement l'inverse du modèle américain dominant, où l'on paye pour accéder à une boîte noire hébergée ailleurs. Voilà pourquoi la date du 27 juillet compte plus que le classement.","en":"A model's weights are the billions of numerical values learned during training. That is the model itself, not its source code. When a company publishes them, anyone can download the file, run it on their own machines, adapt it to their field, audit it. A hospital, a law firm or a public administration can use it without a single line of their data leaving their servers. That is the exact opposite of the dominant American model, where you pay to access a black box hosted elsewhere. Which is why the July 27 date matters more than the leaderboard."}},{"type":"quote","text":{"fr":"Le modèle ouvert le plus puissant jamais publié.","en":"The strongest open model ever released."},"author":"Nathan Lambert, chercheur en IA, sur son blog Interconnects"},{"type":"paragraph","text":{"fr":"Attention quand même à ne pas transformer ça en récit géopolitique simpliste. Un modèle chinois en tête d'un classement, ce n'est pas « la Chine a gagné », c'est un laboratoire qui a fait un bon travail d'ingénierie et qui choisit une stratégie d'ouverture pour exister face à des concurrents mieux financés. La même logique animait Alibaba avec Qwen 3.8 Max il y a quelques semaines. Le vrai rendez-vous, c'est demain : si les poids sortent comme promis, le paysage des modèles utilisables sans dépendre d'un fournisseur bouge d'un coup. S'ils glissent de deux semaines, on saura que l'annonce servait surtout à occuper le terrain.","en":"Still, this should not be turned into a simplistic geopolitical story. A Chinese model topping a leaderboard is not 'China has won,' it is a lab doing good engineering work and choosing openness as a way to exist against better-funded rivals. The same logic drove Alibaba with Qwen 3.8 Max a few weeks ago. The real appointment is tomorrow: if the weights ship as promised, the landscape of models usable without depending on a vendor shifts overnight. If they slip by two weeks, we will know the announcement was mostly about holding ground."}}]