71 milliards de compute, un chairman surprise et l’inference flip : la semaine qui a redistribué les cartes de l’IA

— Agentia Academy

71 milliards de compute, un chairman surprise et l’inference flip : la semaine qui a redistribué les cartes de l’IA

En sept jours, Google a changé de patron opérationnel sur DeepMind, Anthropic a verrouillé plus de 71 Md$ de capacité d’inférence, l’EU AI Act est passé en mode exécution et NVIDIA a présenté son premier rack packagé post-rachat Groq. Le paysage IA de la rentrée 2026 ne ressemblera pas à celui du printemps.

.news-article { max-width: 760px; margin: 0 auto; line-height: 1.65; color: #1c1c1c; font-family: "Urbanist", -apple-system, BlinkMacSystemFont, "Segoe UI", "Helvetica Neue", Arial, sans-serif; -webkit-font-smoothing: antialiased; -moz-osx-font-smoothing: grayscale; } .news-article h1, .news-article h2, .news-article h3 { font-family: "Urbanist", -apple-system, BlinkMacSystemFont, "Segoe UI", "Helvetica Neue", Arial, sans-serif; font-weight: 700; color: #1a1a1a; } .news-article h1 { font-size: 2.1rem; line-height: 1.2; margin: 0 0 1.2rem; letter-spacing: -0.01em; } .news-article h2 { font-size: 1.45rem; margin: 2.4rem 0 0.8rem; letter-spacing: -0.005em; } .news-article p { margin: 0 0 1rem; } .news-article .aa-lede { font-size: 1.18rem; color: #2a2a2a; font-style: italic; margin-bottom: 1.8rem; } .news-article .aa-tldr { background: #faf6ef; border-left: 4px solid #6b4a1f; padding: 1.1rem 1.3rem; margin: 1.5rem 0 2rem; border-radius: 4px; } .news-article .aa-tldr ul { margin: 0.6rem 0 0; padding-left: 1.2rem; } .news-article .aa-tldr li { margin-bottom: 0.35rem; } /* Widget Deals */ .news-article .aa-deals-widget { margin: 2rem 0; border: 1px solid #e6dccb; border-radius: 8px; overflow: hidden; background: #fffdf8; } .news-article .aa-deals-filters { display: flex; flex-wrap: wrap; gap: 0.5rem; padding: 1rem; background: #f6efe2; border-bottom: 1px solid #e6dccb; } .news-article .aa-deals-filter { background: #fff; color: #4a3520; border: 1px solid #d4c6ad; padding: 0.45rem 0.95rem; border-radius: 999px; font-size: 0.88rem; font-weight: 500; cursor: pointer; transition: all 0.15s ease; font-family: inherit; } .news-article .aa-deals-filter:hover { background: #f3e9d3; border-color: #b69968; } .news-article .aa-deals-filter--active { background: #6b4a1f; color: #fff; border-color: #6b4a1f; } .news-article .aa-deals-widget table { width: 100%; border-collapse: collapse; font-size: 0.92rem; } .news-article .aa-deals-widget thead { background: #f6efe2; } .news-article .aa-deals-widget th { text-align: left; padding: 0.75rem 1rem; font-weight: 600; color: #4a3520; border-bottom: 1px solid #e6dccb; } .news-article .aa-deals-widget td { padding: 0.75rem 1rem; border-bottom: 1px solid #f0e8d6; vertical-align: top; } .news-article .aa-deals-widget tbody tr:last-child td { border-bottom: 0; } .news-article .aa-deals-widget tbody tr:hover { background: #faf6ef; } /* Badges */ .news-article .aa-badge { display: inline-block; padding: 0.18rem 0.55rem; border-radius: 4px; font-size: 0.78rem; font-weight: 600; line-height: 1.4; margin-right: 0.35rem; vertical-align: middle; } .news-article .aa-badge--funding { background: #fde8d2; color: #8a4b14; } .news-article .aa-badge--acquisition { background: #f4dcdc; color: #8a2a2a; } .news-article .aa-badge--partnership { background: #dde9f4; color: #1f4a7a; } .news-article .aa-badge--product { background: #e1ecd9; color: #2f5a1f; } .news-article .aa-badge--success { background: #d9eada; color: #1f5a2f; } .news-article .aa-badge--warning { background: #fbeccb; color: #7a5a14; } /* Quiz */ .news-article .aa-quiz { margin: 1.4rem 0; padding: 1.2rem 1.4rem; background: #fffdf8; border: 1px solid #e6dccb; border-left: 4px solid #b69968; border-radius: 6px; } .news-article .aa-quiz-question { font-weight: 600; margin: 0 0 0.9rem; color: #2a2a2a; } .news-article .aa-quiz-choice { display: block; width: 100%; text-align: left; background: #fff; color: #2a2a2a; border: 1px solid #d4c6ad; padding: 0.7rem 1rem; margin-bottom: 0.5rem; border-radius: 6px; font-size: 0.95rem; cursor: pointer; transition: all 0.15s ease; font-family: inherit; } .news-article .aa-quiz-choice:hover { background: #f6efe2; border-color: #b69968; } .news-article .aa-quiz-feedback { margin-top: 0.6rem; font-size: 0.9rem; color: #6b4a1f; font-style: italic; min-height: 1px; } /* Callouts */ .news-article [class^="aa-callout-"] { padding: 1rem 1.2rem; margin: 1.5rem 0; border-radius: 6px; border-left: 4px solid; } .news-article .aa-callout-info { background: #eaf2fb; border-color: #2a6bbf; color: #1c3a66; } .news-article .aa-callout-tip { background: #fdf3e0; border-color: #c97a1a; color: #6b3a0a; } .news-article .aa-callout-warning { background: #fbeccb; border-color: #b88012; color: #6b4a0a; } .news-article .aa-callout-success { background: #e1f0e3; border-color: #2f7a3a; color: #1c4a25; } /* Embed placeholder */ .news-article .aa-embed { margin: 1.5rem 0; padding: 1rem; background: #f6efe2; border: 1px dashed #b69968; border-radius: 6px; text-align: center; font-size: 0.85rem; color: #6b4a1f; } .news-article .aa-embed::before { content: "Embed video"; font-weight: 600; }

71 milliards de compute, un chairman surprise et l’inference flip : la semaine qui a redistribué les cartes de l’IA

En sept jours, Google a changé de patron opérationnel sur DeepMind, Anthropic a verrouillé plus de 71 Md$ de capacité d’inférence, l’EU AI Act est passé en mode exécution et NVIDIA a présenté son premier rack packagé post-rachat Groq. Le paysage IA de la rentrée 2026 ne ressemblera pas à celui du printemps.

Le résumé en 30 secondes
  • Demis Hassabis lâche le pilotage opérationnel de Google DeepMind, Koray Kavukcuoglu prend la relève, Jeff Dean part fonder Discovery Loop.
  • Anthropic annonce 71 Md$ d’engagements de compute pluriannuels et rend opérationnelle sa JV « Ode With Anthropic » avec Blackstone et Hellman & Friedman.
  • L’Article 50 de l’EU AI Act entre en application le 2 août : transparence obligatoire, jusqu’à 15 M€ ou 3% du CA mondial en cas de manquement.
  • OpenAI sort GPT-5.6-Cyber le 10 août, xAI aligne Grok 4.6 sur le tier-1 quatre jours plus tôt à pricing 3× inférieur.
  • MCP devient stateless, Ollama 0.32.6 shipe le format wire OpenAI et Qwen 3.8 27B en natif.
DateActeurOpérationMontant / Détail
Août 2026Fireworks AILevée Série D1 505 M$ — infra d’inférence
Août 2026Together AILevée Série C800 M$ — infra d’inférence
8 août 2026AnthropicCompute Engagements pluriannuels~71 Md$ sur horizon 2027-2028
8 août 2026Anthropic + Blackstone + H&FJV Ode With Anthropic opérationnelle1,5 Md$, 100 ingénieurs
31 juillet 2026AsanaRachat StackAINon divulgué — workflow IA visuel
2026 (intégration finalisée)NVIDIARachat Groq20 Md$ — pivot inférence
10 août 2026OpenAIRelease GPT-5.6-Cyber (Daybreak Blue/Red)95% sur benchmarks cybersécurité
6 août 2026xAIRelease Grok 4.6Score index 61, 2$/6$ par million tokens, 500K contexte
16 juillet 2026MoonshotOpen-weights Kimi K32,8 T paramètres MoE, vision native, 1M contexte
Août 2026OllamaRuntime local 0.32.6Format wire OpenAI, speculative decoding Apple, Qwen 3.8 27B

Google DeepMind : la fin d’une ère, l’aveu d’un retard

Le 8 août 2026, Google a officialisé une réorganisation qui, sous ses dehors de promotion, ressemble beaucoup à un aveu. Demis Hassabis quitte la direction opérationnelle de DeepMind pour devenir Chairman et Chief Scientist d’Alphabet, un rôle statutaire qui l’éloigne du pilotage quotidien. Le CTO Koray Kavukcuoglu récupère la barre. Dans la foulée, Jeff Dean, entré chez Google en 1999, quitte la maison après 27 ans pour cofonder Discovery Loop avec plusieurs chercheurs seniors.

Le contexte : Google n’a pas sorti de modèle frontier depuis le début 2026, laissant OpenAI et Anthropic dicter le tempo. La communication officielle parle de « clarification des rôles ». Le décodage est plus simple : la structure existante n’a pas produit assez vite, la promotion de Hassabis lui permet de continuer à influer sans porter la responsabilité de la vitesse, et le départ de Jeff Dean crée un précédent qui va peser sur la rétention. La question qui vaut de l’argent pour la fin d’année : Kavukcuoglu peut-il livrer un modèle qui reprend la tête sur l’Artificial Analysis Intelligence Index avant décembre, ou faut-il patienter jusqu’à Gemini 3 Ultra en 2027 ?

Anthropic : 71 milliards de compute, un pari sur l’usage 2027

Le même 8 août, Anthropic a annoncé environ 71 Md$ d’engagements de compute pluriannuels. Pour donner un ordre de grandeur : c’est l’équivalent d’un an et demi de chiffre d’affaires de Netflix, ou trois fois la valorisation d’OpenAI en 2022. La lecture naïve est celle d’une fuite en avant. La lecture business est plus intéressante : Anthropic paie aujourd’hui, à un prix négocié dur, la capacité d’inférence dont elle aura besoin quand ses clients entreprise passeront de la phase pilote à la production.

Sur la même journée, la JV « Ode With Anthropic », lancée avec Blackstone et Hellman & Friedman en mai, devient opérationnelle avec 100 ingénieurs dédiés à l’implémentation en entreprise. Ce mouvement copie explicitement le playbook Accenture-Salesforce des années 2010, mais compressé sur deux ans au lieu de dix. Le pari sous-jacent : l’usage entreprise fera 10× sur 24 mois, et le vrai goulot ne sera pas le modèle mais la capacité à déployer chez le client. Le risque symétrique : si l’usage plateau à 3× ou 4×, Anthropic se retrouve avec du compute payé mais sous-utilisé. À suivre au bilan Q4.

EU AI Act : la transparence devient une contrainte opérationnelle

Depuis le 2 août 2026, la Commission européenne applique les obligations de transparence de l’Article 50. En pratique : les contenus générés par IA doivent être identifiables via un marquage machine-readable, et un utilisateur qui interagit avec un système IA doit en être informé. Les sanctions vont jusqu’à 15 M€ ou 3% du CA mondial, selon le montant le plus élevé.

Pour les frontier labs qui opèrent en Europe, la contrainte technique est réelle mais gérable ; le vrai casse-tête concerne les intégrateurs et les créateurs qui bricolent des pipelines mêlant humain, IA générative et retouche manuelle. À partir de quel taux de contribution IA faut-il labelliser une image ? Un texte réécrit à 30% par un LLM ? Une voix clonée à partir de 30 secondes d’échantillon ? Les décrets d’application arriveront en fin d’année. En attendant, les grands acteurs adoptent une posture de sur-conformité prudente. Meta est déjà exposée à une amende séparée de 360 à 430 M€ pour du traitement de données lié à l’entraînement, ce qui pèse sur les négociations en cours. L’effet secondaire silencieux : les startups qui construisent en Europe intègrent le watermarking dès la conception, celles qui construisent aux États-Unis considèrent l’Europe comme une friction, et le fossé produit se creuse.

Frontier models : deux releases en quatre jours, un plafond visible

Le 6 août, xAI a livré Grok 4.6. Le 10 août, OpenAI a répliqué avec GPT-5.6-Cyber. Grok 4.6 aligne son score sur l’Artificial Analysis Intelligence Index à 61, exactement comme GPT-5.6 Sol Max, pour un pricing de 2 $ en entrée et 6 $ en sortie par million de tokens — soit environ trois fois moins cher qu’OpenAI sur le tier haut. Le contexte grimpe à 500 000 tokens. Sur CursorBench, Grok passe de 66,7% à 69,9% et s’installe sur APEX-Agents.

GPT-5.6-Cyber, de son côté, marque un tournant structurel : c’est la première déclinaison verticalisée de la famille 5.6, avec les modes Daybreak Blue et Red, et 95% annoncés sur les benchmarks de sécurité offensive et défensive. Deux signaux à retenir. D’abord, l’écart au sommet se resserre, ce qui va comprimer les marges des labs qui ne différencient pas ailleurs que sur le score brut. Ensuite, la segmentation par verticale commence, et elle va accélérer : Cyber cette semaine, Legal et Medical d’ici décembre selon toute logique. La logique n’est plus « un modèle géant qui fait tout », mais « un socle plus une famille de modèles spécialisés qui capturent la valeur métier ».

L’inference flip : NVIDIA rebadge Groq, la couche silicium se réorganise

NVIDIA a finalisé l’intégration de Groq, acquis pour 20 Md$, en présentant le Groq 3 LPX : un rack de 128 LPU couplable aux Vera Rubin NVL72. La promesse chiffrée est agressive : 35× le throughput par mégawatt, 10× l’opportunité de revenu par rack. Le contexte macro justifie l’investissement : en 2026, les workloads d’inférence représentent désormais les deux tiers de l’ensemble du compute IA, contre un tiers pour l’entraînement — c’est l’inference flip. Les ASIC custom croissent à 44,6% par an, contre 16,1% pour les GPU.

AMD, de son côté, résiste avec le MI350/MI355 sur le rapport mémoire-prix et prépare le MI500 pour 2027 en promettant jusqu’à 1 000× l’efficacité du MI300X sur CDNA 6. Pour les startups d’inférence pure — Fireworks, Together, Cerebras — l’équation change : elles ne se battent plus contre NVIDIA sur les GPU génériques, elles se battent contre un stack packagé qui combine training et inference sous une même marque. Fireworks vient de lever 1,505 Md$ et Together 800 M$ pour tenir ce choc, ce qui donne la mesure de la barrière à l’entrée sur ce segment.

Outillage : MCP passe stateless, Ollama devient un drop-in OpenAI

Le 28 juillet 2026, le protocole MCP a shippé sa version stateless : suppression des sessions et de la phase initialize. Le GitHub MCP server a implémenté le support en avance sur la spec officielle. Ce changement, ignoré par la presse grand public, a un impact concret énorme : les serveurs MCP peuvent désormais être hébergés en serverless sur Lambda, Cloudflare Workers ou Vercel Functions sans hack de gestion d’état externe. La barrière au déploiement de MCP en production tombe.

En parallèle, Ollama 0.32.6 a aligné son endpoint /v1/chat/completions sur le format wire OpenAI, activé le speculative decoding sur GPU Apple via la MTP head du modèle, et intégré Qwen 3.8 27B en natif. Traduction : migrer un script écrit contre l’API OpenAI vers un runtime local Ollama ne demande plus qu’un changement de base URL. La couche outillage rattrape enfin la couche modèle. Pour un développeur qui construit un agent en 2026, la question « cloud ou local » cesse d’être un choix architectural pour devenir un choix d’exécution, décidable à chaque appel.

Testez votre lecture de la semaine

Quel rôle Koray Kavukcuoglu occupe-t-il après la réorg Google du 8 août 2026 ?

Combien Anthropic a-t-elle sécurisé en engagements de compute pluriannuels ?

Quelle est la sanction maximale prévue par l’Article 50 de l’EU AI Act ?

Quel est le pricing en sortie annoncé pour Grok 4.6 par million de tokens ?

Quelle est la principale nouveauté du protocole MCP shippée le 28 juillet 2026 ?

À retenir pour la semaine prochaine : surveiller si Google annonce un modèle frontier avant fin septembre. C’est le seul signal qui validera ou invalidera la thèse du retard structurel de DeepMind. Regarder aussi les premières mises en demeure « transparence Article 50 » en Europe : le régulateur va choisir un ou deux cas emblématiques pour poser la jurisprudence.

← Toutes les actualités IA · Nos formations IA