Google DeepMind se réorganise, l'Europe met l'AI Act sous tension, NVIDIA Rubin sort de l'atelier
Semaine dense pour l'écosystème IA : reorg surprise au sommet de Google DeepMind, entrée en application des règles de transparence de l'AI Act européen le 2 août 2026, montée en cadence de la plateforme NVIDIA Rubin et bras de fer capitalistique côté Anthropic. On fait le point sur les mouvements qui vont peser sur les six prochains mois.
- Demis Hassabis quitte la direction opérationnelle de Google DeepMind au profit de Koray Kavukcuoglu ; Jeff Dean part fonder Discovery Loop après 27 ans chez Google.
- L'AI Act européen entre en application le 2 août 2026 : chatbots, deepfakes et contenus générés doivent porter une signalétique, sous peine de 15 M€ ou 3% du CA mondial.
- NVIDIA passe la plateforme Rubin en production avec une promesse de -10× sur le coût d'inférence face à Blackwell ; AMD ramp le MI400 à ~258 000 unités et signe la première gigawatt-scale chez Meta avec le MI450.
- Anthropic cumule ~71 Md$ de compute engagés et lance la JV Ode With Anthropic à 1,5 Md$ avec Blackstone et Hellman & Friedman.
- Open source : Kimi K3 (2,8 T de paramètres, contexte 1 M) sorti le 16 juillet, Qwen 3.7 Flash le 27 juillet, ByteDance Seed 2.1 Turbo le 10 août maintiennent la pression tarifaire.
La reorg Google DeepMind pose une question qu'on n'osait pas formuler
Le 8 août 2026, Alphabet a annoncé que Demis Hassabis quittait la direction opérationnelle quotidienne de Google DeepMind pour devenir chairman de DeepMind et chief scientist d'Alphabet. Koray Kavukcuoglu, CTO en poste, récupère les opérations. Le même jour, Jeff Dean, en poste depuis 27 ans, a quitté Google pour lancer Discovery Loop avec plusieurs chercheurs seniors. Deux départs symboliques dans la même journée, ce n'est jamais un hasard de calendrier.
Le contexte industriel est brutal : Google n'a plus livré de modèle frontier depuis début 2026, pendant qu'OpenAI et Anthropic accumulent les sorties — Claude Opus 5 le 24 juillet 2026, plusieurs releases GPT côté OpenAI. La presse américaine lit la reorg comme une reconnaissance implicite du retard, en particulier sur le champ de bataille du coding agentique où Cursor et Devin Desktop (ex-Windsurf) captent l'attention des développeurs. La question qu'on peut poser sans mauvaise foi : est-ce que le fait d'avoir 5% du portefeuille d'un géant permet vraiment de rivaliser avec un pure-player qui joue sa survie tous les six mois ?
L'AI Act européen entre en application : la transparence devient opposable
Depuis le 2 août 2026, la Commission européenne applique officiellement les règles de transparence de l'AI Act, avec l'AI Office et les autorités nationales aux manettes. Concrètement, tout chatbot déployé en Europe doit désormais informer l'utilisateur qu'il interagit avec une IA, les deepfakes doivent être étiquetés comme tels et les contenus générés ou modifiés par IA doivent porter un marquage machine-readable. Les amendes maximales atteignent 15 M€ ou 3% du chiffre d'affaires mondial, montant le plus élevé.
Le calendrier plus lourd — celui des systèmes haut risque listés en Annexe III — a été repoussé au 2 décembre 2027 par l'AI Omnibus, et jusqu'au 2 août 2028 pour les IA intégrées à des produits déjà régulés. Cette respiration donne 18 mois aux déployeurs pour instrumenter risque, documentation technique et supervision humaine. Point d'attention pour les opérateurs francophones : un simple formulaire de contact "IA-assisté" non signalé sur un site européen constitue déjà une exposition juridique réelle. Les cabinets d'audit sont déjà en train de vendre du "AI Act readiness" à prix fort.
NVIDIA Rubin en production, AMD MI450 chez Meta : la bataille du silicium se stabilise
NVIDIA a basculé en full production la plateforme Rubin, un ensemble intégré de six puces : Vera CPU, Rubin GPU, NVLink 6 Switch, ConnectX-9 SuperNIC, BlueField-4 DPU et Spectrum-6 Ethernet Switch. Les premiers systèmes sont livrés au second semestre 2026 chez AWS, Microsoft Azure et Google Cloud. La promesse annoncée : jusqu'à 10 fois moins de coût d'inférence par token et 4 fois moins de GPU pour entraîner un modèle Mixture-of-Experts, comparé à Blackwell. Les volumes réalistes 2026 sont plafonnés autour de 200 à 300 000 unités par la capacité wafer-out N3 de TSMC.
Face à ce récit, AMD ne joue plus la figuration : le MI400 monte en cadence à environ 258 000 unités sur 2026 depuis une base quasi nulle en 2025, et le MI450 est la puce retenue par Meta pour son premier déploiement à l'échelle gigawatt au second semestre. C'est la première fois qu'un hyperscaler majeur commande AMD pour son build principal, pas juste en complément. Groq et Cerebras continuent leur travail sur l'inférence spécialisée mais restent marginaux en part de marché. Si les chiffres Rubin tiennent en prod, la marge unitaire de tous les wrappers IA grand public sera redistribuée avant fin 2027.
Anthropic pousse ses pions sur le go-to-market entreprise
Anthropic a confirmé environ 71 Md$ de compute commitments cumulés, un chiffre qui dépasse le budget annuel R&D de la plupart des groupes industriels du CAC 40 réunis. Le 4 août 2026, la nomination de Mariano-Florentino "Tino" Cuéllar comme premier Chief Global Affairs Officer signale que le labo passe en mode lobbying institutionnel, très en retard d'un cran par rapport à OpenAI mais avec un profil plus sénior sur les enjeux souverains.
Côté monetisation, la JV Ode With Anthropic annoncée en mai 2026 avec Blackstone et Hellman & Friedman est désormais opérationnelle : 1,5 Md$ de capital, 100 ingénieurs sur le terrain pour déployer des cas d'usage IA dans les portefeuilles des deux fonds. C'est une stratégie originale : plutôt que vendre un SaaS à la marge, Anthropic prend une participation indirecte dans la transformation IA des entreprises tenues par ses partenaires financiers. Si le modèle marche, il devient réplicable avec KKR, Apollo ou Bain. C'est aussi une réponse concurrentielle à Microsoft, qui a longtemps eu le monopole du canal de distribution enterprise via Copilot.
Open source : la Chine impose la cadence, l'Occident absorbe le choc
Trois releases open weights récentes méritent l'attention. Kimi K3 (Moonshot), sorti le 16 juillet 2026, offre un modèle Mixture-of-Experts de 2,8 trillions de paramètres avec vision native et fenêtre de contexte 1 million de tokens, sous licence permissive. Qwen 3.7 Flash (Alibaba), le 27 juillet, cible la production laténce-sensible. ByteDance a ajouté Seed 2.1 Turbo le 10 août. En parallèle, DeepSeek R1/V3 et Mistral Large 3 restent des références 2026, avec un écosystème runtime local (LM Studio, Ollama, vLLM, llama.cpp, MLX) qui rend ces modèles opérables sur du hardware grand public.
L'écart de qualité entre le meilleur modèle fermé et le meilleur modèle ouvert s'est resserré à environ trois à quatre mois selon les benchs agent long-horizon — contre douze mois il y a un an. Conséquence directe pour un opérateur SaaS francophone : concevoir aujourd'hui une roadmap qui repose exclusivement sur GPT-4 ou Claude comme moat technologique, c'est ignorer un signal fort. La question n'est plus "quel LLM je choisis" mais "quelle architecture me permet de swap en 48h quand un modèle ouvert à -80% de coût sort le mois prochain".
Testez votre lecture de la semaine
Qui prend la direction opérationnelle quotidienne de Google DeepMind après le 8 août 2026 ?
Quelle est l'amende maximale prévue par l'AI Act pour non-respect des règles de transparence appliquées le 2 août 2026 ?
Quel gain d'inférence NVIDIA annonce-t-il pour la plateforme Rubin face à Blackwell ?
Combien de compute commitments Anthropic revendique-t-il cumulés ?
Quel modèle open weights sorti le 16 juillet 2026 revendique une fenêtre de contexte d'1 million de tokens ?