71 Md$ de compute verrouillés, Google se recompose, l’open source chinois pousse : la semaine qui réorganise l’IA
La bataille pour l’IA a changé de terrain cette semaine. Elle ne se joue plus seulement sur les benchmarks mais sur trois lignes en parallèle : capacité de calcul verrouillée à long terme, gouvernance des labos frontière, et accélération continue des modèles open weights chinois. Trois signaux faibles devenus impossibles à ignorer.
- Anthropic dévoile environ 71 Md$ d’engagements compute et lance une JV de 1,5 Md$ avec Blackstone et Hellman & Friedman.
- Google DeepMind se restructure : Demis Hassabis devient chairman et Chief Scientist d’Alphabet, Koray Kavukcuoglu prend le poste opérationnel, Jeff Dean quitte après 27 ans.
- Z.AI publie GLM-5.3 le 14 août 2026 et GLM-5.2 Turbo le 17 août 2026, tous deux en licence MIT.
- NVIDIA lance le Groq 3 à GTC 2026, revendiquant 35× throughput par MW vs Blackwell NVL72.
- FLI Safety Index été 2026 : aucun labo au-dessus de C+, Anthropic en tête à 2,66.
Le compute devient un actif verrouillé à long terme
La news la plus structurante de la semaine n’est pas un modèle mais un chiffre : environ 71 Md$ d’engagements compute cumulés dévoilés par Anthropic autour du 8 août 2026. Ce n’est pas une levée, c’est un carnet de commandes acheté d’avance auprès des hyperscalers et des spécialistes de l’inférence. La logique est simple : la ressource rare des trois prochaines années n’est plus le talent chercheur, c’est le GPU disponible en 2027 et 2028.
Dans la même semaine, Anthropic annonce « Ode With Anthropic », une JV dotée de 1,5 Md$ avec Blackstone et Hellman & Friedman, staffée à 100 ingénieurs, dont la cible est explicite : banques mid-market, systèmes de santé et industriels, en déploiement souverain. Traduction : la couche modèle se banalise, la couche intégration régulée devient le vrai lieu de la marge. La question pour un CTO en 2026 n’est plus « quel modèle ? » mais « quel contrat de capacité ai-je pour janvier 2028 ? ».
Google DeepMind acte publiquement son retard
Le 8 août 2026, Google a annoncé une restructuration qui vaut aveu : Demis Hassabis quitte le poste opérationnel de DeepMind pour devenir chairman et Chief Scientist d’Alphabet, Koray Kavukcuoglu monte CTO au commandement de DeepMind, et Jeff Dean, après 27 ans de maison, part fonder « Discovery Loop » avec plusieurs chercheurs seniors. Ce triple mouvement, couplé à un rebalancement du centre de gravité IA vers la Californie, dit la même chose de trois manières différentes : la maison mère n’attend plus la prochaine version majeure pour agir.
La lecture de marché est brutale. Google, qui inventait l’architecture Transformer en 2017, court aujourd’hui derrière OpenAI et Anthropic sur les modèles frontière. Le départ de Jeff Dean, après un quart de siècle, n’est pas seulement un départ symbolique : c’est une force résiduelle d’innovation qui s’installe en dehors de l’organigramme. Discovery Loop rejoint la petite liste des « spinouts de niveau senior » qui redistribuent les cartes indépendamment des cinq gros labos.
L’open source chinois publie plus vite que tout le monde
Le mois d’août 2026 aura vu 12 nouveaux modèles publiés côté open weights, provenant de 7 fournisseurs. Trois ancrages : Alibaba avec Qwen3.8 Max le 2 août, Z.AI avec GLM-5.3 le 14 août puis GLM-5.2 Turbo le 17 août. GLM-5.2 tient désormais le score de 62,1% sur SWE-bench Pro, ce qui en fait le meilleur modèle sous licence MIT du marché. En parallèle, Kimi K3 publié par Moonshot le 27 juillet 2026 reste le meilleur open weights toutes catégories : 88,3 sur Terminal-Bench 2.1, 2,8 T de paramètres totaux dont 104 B actifs, contexte 1 M.
La conséquence opérationnelle pour une équipe francophone en 2026 : le délai entre « un modèle propriétaire dominant » et « son équivalent open weights exécutable localement » est descendu sous les six semaines. C’est précisément l’horizon où une stratégie d’infrastructure locale (LM Studio, Ollama, vLLM, llama.cpp) devient un pari raisonnable pour des cas d’usage confidentiels, sans sacrifice de qualité insécurisant. DeepSeek-V4-Pro, avec 80,6% sur SWE-bench Verified sous MIT, complète le tableau.
NVIDIA verrouille l’inférence avec Groq 3
À GTC 2026, NVIDIA a lancé Groq 3 et Vera CPU, fruits directs de son rachat de Groq à 20 Md$, le plus gros deal de son histoire. La promesse : 35× throughput par mégawatt vs Blackwell NVL72 sur les modèles trillion-paramètres, avec un positionnement inférence assumé. C’est un signal envoyé à AMD (qui progresse mais reste seul challenger crédible) et à Intel (dont la position data-center s’érode). C’est aussi un signal aux acteurs alternatifs de l’inférence (Cerebras, SambaNova) : l’espace se referme.
Pour les décideurs achats, cela réinstall de facto NVIDIA sur les deux étages du stack : entraînement (Blackwell) et inférence à grande échelle (Groq 3). L’effet réseau devient un piège doux : sortir de CUDA, encore possible en 2024, coûte de plus en plus cher en 2026 quand le vendeur unique maîtrise la totalité de la chaîne. AMD publie un 64% de croissance projetée EPS 2026 et un ratio PEG entre 0,4 et 0,5 : les fondamentaux financiers sont bons, la position technologique reste inconfortable.
Outils dev IA : Cursor sous SpaceX, Claude Code sur Opus 5, Codex sur GPT-5.6
Côté assistants de code, la carte se stabilise autour de trois pôles. Le 16 juin 2026, SpaceX a signé un accord de fusion pour racheter Anysphere (Cursor) pour 60 Md$ en stock, closing prévu au troisième trimestre : le plus gros deal M&A startup de l’année. Cursor, sur son propre agenda produit, a rebattu son UX autour de multi-agents parallèles et d’environnements cloud isolés par Dockerfile. Fin d’une ère composer unique.
Du côté des modèles, GPT-5.6 Sol (GA le 9 juillet 2026) atteint 89,5% sur Terminal-Bench en extra-high effort, Claude Opus 5 (mise en défaut de Claude Code depuis le 24 juillet 2026) plafonne à 89,1% en max effort. Claude Fable 5, restauré le 1er juillet 2026, tient toujours 95,0% sur SWE-bench Verified. Windsurf s’est fait absorber dans Devin Desktop côté Cognition : le domaine windsurf.com/pricing redirige vers devin.ai/pricing. La consolidation se joue à l’échelle des IDE, pas seulement des modèles.
Sécurité : aucun labo au-dessus de C+
Le Future of Life Institute a publié son AI Safety Index été 2026. Aucun labo frontière ne dépasse la note C+. Le classement : Anthropic C+ à 2,66, OpenAI C, Google DeepMind C, Meta D+, xAI, DeepSeek et Mistral F. C’est la première fois qu’une notation indépendante trace aussi nettement une ligne entre labos anglosaxons régulés et autres. La lecture n’est ni héroïque ni catastrophiste : même le premier de la classe reste dans une moyenne basse.
Sur la même période, OpenAI, Anthropic et Google ont participé à une réunion AI Safety à la Maison-Blanche autour du 3 août 2026, signe que la coordination institutionnelle US se maintient malgré la compétition. Pour un dirigeant français qui déploie de l’IA en production en 2026, la question à documenter n’est plus « quel labo est sûr ? » mais « quel niveau de résiduel accepté par le comité risque ? » Le C+ d’Anthropic est un plafond, pas un plancher.
Testez votre lecture de la semaine
Quel montant Anthropic a-t-il dévoilé en engagements compute cumulés ?
Qui prend les commandes opérationnelles de Google DeepMind après la restructuration du 8 août 2026 ?
Quel est le meilleur modèle open weights toutes catégories en août 2026, selon Terminal-Bench 2.1 ?
Quel gain de throughput par MW NVIDIA revendique-t-il pour Groq 3 vs Blackwell NVL72 ?
Quel labo est en tête du FLI AI Safety Index été 2026 ?