[{"type":"paragraph","text":{"fr":"Tu ouvres la page de tarifs de l'API Gemini un lundi matin, et les chiffres ont encore changé, dans le bon sens pour une fois. Le 21 juillet, Google DeepMind a dégainé trois modèles d'un coup : Gemini 3.6 Flash, le nouveau cheval de trait maison, Gemini 3.5 Flash-Lite pour les tâches à haut débit, et un Gemini 3.5 Flash Cyber spécialisé dans la détection de vulnérabilités. Le tout deux semaines après l'offensive GPT-5.6 d'OpenAI qu'on décortiquait ici même.","en":"You open the Gemini API pricing page on a Monday morning, and the numbers have changed again, in the right direction for once. On July 21, Google DeepMind pulled out three models at once: Gemini 3.6 Flash, the new house workhorse, Gemini 3.5 Flash-Lite for high-throughput tasks, and a Gemini 3.5 Flash Cyber built for vulnerability detection. All two weeks after OpenAI's GPT-5.6 offensive we broke down right here."}},{"type":"paragraph","text":{"fr":"Petit rappel utile si tu ne vis pas dans les docs d'API. Chez Google, la gamme Flash désigne les modèles rapides et bon marché, pensés pour tourner des millions de fois par jour dans une application, par opposition aux modèles Pro réservés aux tâches lourdes. C'est la catégorie qui fait tourner l'économie réelle de l'IA : les chatbots de support, les résumés, la classification, tout ce qui s'exécute en arrière-plan sans que personne n'admire le résultat.","en":"A quick reminder if you don't live in API docs. At Google, the Flash range means the fast, cheap models, built to run millions of times a day inside an app, as opposed to the Pro models reserved for heavy work. It's the tier that runs the real economy of AI: support chatbots, summarization, classification, everything executing in the background with nobody admiring the output."}},{"type":"paragraph","text":{"fr":"Le pitch de 3.6 Flash tient en une ligne : faire pareil ou mieux, en consommant moins. Google annonce 17 % de tokens de sortie en moins que 3.5 Flash, moins d'étapes de raisonnement pour les mêmes workflows, et un prix qui descend à 7,50 dollars le million de tokens en sortie, contre 9 auparavant. La double économie compte plus que la baisse affichée : tu paies moins cher un volume que tu réduis en même temps.","en":"The 3.6 Flash pitch fits in a line: do the same or better while consuming less. Google claims 17% fewer output tokens than 3.5 Flash, fewer reasoning steps for the same workflows, and a price falling to 7.50 dollars per million output tokens, down from 9. The double saving matters more than the headline cut: you pay less for a volume you're also shrinking."}},{"type":"paragraph","text":{"fr":"C'est devenu le vrai terrain de bataille. Depuis que les modèles raisonnent avant de répondre, ils produisent des tokens invisibles que le client paie quand même. Un modèle qui réfléchit moins longtemps pour arriver au même résultat coûte donc mécaniquement moins cher à faire tourner, même à prix affiché égal. Après le mois de juin record qu'on résumait ici, la guerre ne se joue plus sur le prestige des benchmarks mais sur la facture mensuelle des développeurs.","en":"That's become the real battlefield. Since models reason before answering, they produce invisible tokens the customer still pays for. A model that thinks for less time to reach the same result therefore costs mechanically less to run, even at an identical sticker price. After the record June we recapped here, the war is no longer about benchmark prestige but about developers' monthly bill."}},{"type":"heading","text":{"fr":"Flash Cyber, l'outil à double tranchant","en":"Flash Cyber, the double-edged tool"}},{"type":"paragraph","text":{"fr":"Le deuxième modèle mérite qu'on s'arrête. Flash Cyber est entraîné à détecter, valider et corriger des failles de sécurité à grande échelle, et son accès complet est réservé à des acteurs gouvernementaux et à des partenaires triés. Ce n'est pas de la science-fiction : dès 2024, l'agent Big Sleep de Google avait trouvé une vraie vulnérabilité inédite dans SQLite, une base de données présente sur des milliards d'appareils, avant qu'elle n'atterrisse en production.","en":"The second model deserves a stop. Flash Cyber is trained to find, validate and patch security flaws at scale, and full access is limited to government actors and vetted partners. This isn't science fiction: back in 2024, Google's Big Sleep agent found a genuine previously unknown vulnerability in SQLite, a database sitting on billions of devices, before it reached production."}},{"type":"paragraph","text":{"fr":"L'intention défensive est louable, et l'asymétrie est réelle : trouver une faille avant un attaquant, c'est du temps gagné pour tout le monde. Mais un modèle qui trouve des failles est, par construction, un modèle qui sait où elles sont. La liste de qui y accède, et pour quoi faire, mériterait d'être aussi publique que le communiqué de lancement. C'est le débat le plus important du moment sur l'IA, et il se joue à huis clos.","en":"The defensive intent is fair, and the asymmetry is real: finding a flaw before an attacker does buys everyone time. But a model that finds flaws is, by construction, a model that knows where they are. The list of who gets access, and for what, deserves to be as public as the launch announcement. It's the most important AI debate of the moment, and it's happening behind closed doors."}},{"type":"paragraph","text":{"fr":"Reste le teaser : Google évoque déjà la suite, et la rumeur Gemini 4 enfle. Au rythme mensuel de cette industrie, on ne prend pas un gros risque en te donnant rendez-vous à la rentrée. Le réflexe utile si tu construis quelque chose dessus : ne cale jamais ton code sur un numéro de version précis, et regarde le coût par tâche accomplie plutôt que le prix au million de tokens. C'est la seule métrique qui reflète ce que tu paies vraiment.","en":"That leaves the teaser: Google is already hinting at what's next, and the Gemini 4 rumor is swelling. At this industry's monthly pace, promising you a September update is a safe bet. The useful reflex if you're building on it: never pin your code to an exact version number, and look at cost per completed task rather than price per million tokens. That's the only metric reflecting what you actually pay."}}]