Gemini double le contexte, Fable 5 stoppé par décret : sept jours qui rebattent la hiérarchie de l’IA
En une semaine, Google reprend la tête des benchmarks avec 2 millions de tokens de contexte, l’administration américaine suspend un modèle Anthropic au nom du contrôle à l’export, et Z.ai pousse 744 milliards de paramètres en open weights. Le rapport de force des labos frontaliers a changé trois fois en sept jours.
- Google : Gemini 2.5 Pro Deep Think prend la tête des benchmarks raisonnement avec 2 millions de tokens de contexte.
- Anthropic : Claude Fable 5, lancé le 9 juin 2026, suspendu trois jours plus tard par décret américain ; valorisation privée à 965 Md$.
- Z.ai publie GLM-5.2 (744 Md de paramètres, MIT) le 13 juin ; DeepSeek V4-Pro à 0,2 point de Claude Opus sur SWE-bench.
- Windsurf devient Devin Desktop, Cursor restructure ses prix Teams, GitHub Copilot bascule en usage-based.
- Le décret Trump du 2 juin et l’AI Act applicable le 2 août signent une bifurcation réglementaire US/UE.
Google reprend la couronne benchmarks avec 2 millions de tokens
Après un printemps dominé par Anthropic côté coding et par OpenAI sur le grand public, Google a remis la pression cette semaine en poussant Gemini 2.5 Pro en mode Deep Think. Le modèle se place en tête des benchmarks science, maths et raisonnement général, avec une fenêtre de contexte stable de 2 millions de tokens — soit le double de ce que proposent OpenAI ou Anthropic en production.
Concrètement, cela signifie qu’un développeur peut charger d’un coup une base de code de plusieurs centaines de fichiers, un dossier juridique entier, ou plusieurs centaines d’heures de transcription audio sans recourir à du RAG. La proposition n’est pas un effet d’annonce : Google capitalise sur son intégration verticale TPU + DeepMind + Search, là où ses concurrents louent encore l’essentiel de leur compute. C’est probablement la première fois depuis 2023 qu’un labo affiche simultanément leadership benchmark, contexte le plus large et coût par token compétitif. La concurrence va devoir répondre, et il est probable que les prochaines releases Anthropic et OpenAI suivent le même cap : contextes plus larges, modes « reasoning long » par défaut, facturés à l’usage et non plus à l’abonnement.
Anthropic : Fable 5 stoppé trois jours après son lancement
Le 9 juin 2026, Anthropic a ouvert l’accès à Claude Fable 5, premier modèle publiquement disponible de la classe « Mythos », facturé 10$ d’input et 50$ d’output par million de tokens. Trois jours plus tard, le 12 juin, l’administration américaine a imposé une suspension immédiate pour tous les clients via une directive de contrôle à l’export. La fenêtre gratuite annoncée en parallèle expire sans extension publiée.
Premier signal : les contrôles à l’export américains ne ciblent plus seulement le silicium NVIDIA expédié vers la Chine, ils touchent désormais directement les capacités de modèles frontaliers, même lorsque l’éditeur est américain. Pour Anthropic, l’épisode arrive au pire moment commercial mais au meilleur moment financier : la société vient de déposer un IPO confidentiel sur une valorisation autour de 965 milliards de dollars, portée par la traction de Claude Code auprès des développeurs. L’ironie est que la suspension d’un modèle frontalier rappelle aussi aux investisseurs que le risque réglementaire est désormais un facteur de discount valorisation réel, et non plus théorique.
Open weights : Z.ai et la nouvelle série GLM-5.2
Le 13 juin 2026, Z.ai a publié GLM-5.2 sous licence MIT : 744 milliards de paramètres en Mixture-of-Experts, contexte stable à 1 million de tokens, gains nets en coding et en agentique par rapport à la 5.1. En quelques jours, Nous Research a intégré le modèle dans son Hermes Agent, ce qui confirme la vitesse d’adoption typique de l’écosystème open weights chinois.
Plus largement, la semaine confirme que l’écart entre modèles propriétaires et open weights se mesure désormais en dixièmes de point : DeepSeek V4-Pro atteint 80,6% sur SWE-bench Verified, contre 80,8% pour Claude Opus 4.6, sous licence MIT. Kimi K2.7 Code HighSpeed (Moonshot) revendique 6 fois la vitesse d’inférence multimodale de K2.6, avec un score MCP Atlas de 76.0 et MCP Mark Verified de 81.1. MiniMax M3, publié en juin, devient le premier open-weight à combiner coding frontalier, contexte 1M et multimodalité native, avec 59,0% sur SWE-Bench Pro. La conséquence : les entreprises qui déployent en interne disposent désormais d’alternatives qui auraient été impensables il y a six mois.
Outils dev IA : rebrand Cognition, repricing Cursor, bascule Copilot
Le 2 juin 2026, Cognition a retiré la marque Windsurf pour relancer l’IDE sous le nom Devin Desktop. La bascule n’est pas cosmétique : l’Agent Command Center devient la surface par défaut, et surtout l’outil supporte nativement l’Agent Client Protocol (ACP), donc Codex, Claude Agent, OpenCode et d’autres agents conformes ACP peuvent y tourner. C’est le premier IDE majeur à assumer un modèle multi-agent ouvert, là où Cursor reste verrouillé sur son propre stack.
Cursor justement : la grille Teams a été restructurée en juin avec deux niveaux clairs, Standard à 32$/siège/mois en annuel (40$ en mensuel) et Premium à 96$/siège/mois en annuel (120$ en mensuel) avec 5 fois l’usage du Standard. C’est un mouvement vers la prédictibilité B2B, dans la même direction que GitHub Copilot qui bascule officiellement en usage-based depuis le 1er juin 2026. Le « tout illimité » comme outil d’acquisition vit ses derniers mois : les services finance directeurs des grands comptes commencent à demander des lignes budgétaires distinctes pour l’usage IA, distinctes des licences logicielles classiques.
Infra et silicium : 190 Md$ Microsoft, 20 Md$ Amazon, Cerebras à 57 Md$
Microsoft a annoncé un capex 2026 attendu à 190 milliards de dollars, dont environ 25 milliards directement attribuables à la flambée des prix de la mémoire et du stockage entraînée par la demande d’infrastructure IA. Amazon, de son côté, a confirmé que son activité silicium custom (Trainium, Inferentia) dépasse désormais 20 milliards de dollars de run rate annuel, en croissance supérieure à 100% par an, ce qui en fait l’une des trois plus grandes activités chips data center au monde.
Côté alternatives à NVIDIA, Cerebras a finalisé son IPO à 57 milliards de dollars fin mai 2026 et assume une stratégie de partenariat avec tous les fabricants sauf NVIDIA. d-Matrix est entré en production pleine en juin sur sa plateforme Corsair (architecture in-memory SRAM) avec un gain mesuré de plus de 10x face aux GPU sur certaines charges d’inférence. SambaNova SN50 revendique 5x la vitesse des compétiteurs et un TCO 3x inférieur sur agentique. Le message convergent : l’inférence devient un marché spécialisé où le GPU généraliste perd ses avantages. NVIDIA garde le training, mais la rente sur l’inference va se contracter en 2027.
Régulation : l’Amérique détricote, l’Europe finit l’Omnibus
Le 2 juin 2026, Donald Trump a signé le décret « Promoting Advanced Artificial Intelligence Innovation and Security », dans la continuité de l’ordre exécutif de décembre 2025 qui bloque toute loi d’État jugée trop restrictive. La posture est explicite : pas de régulation lourde au niveau fédéral, contrôles à l’export ciblés sur les capacités frontalières, et primauté donnée à la compétitivité américaine.
De l’autre côté de l’Atlantique, le Parlement européen a adopté le 16 juin 2026 l’accord provisoire sur le Digital Omnibus AI, qui ajuste l’application de l’AI Act avec une période de transition prolongée jusqu’au 2 août 2028 pour les systèmes haut risque embarqués dans des produits déjà régulés. L’application générale de l’AI Act reste fixée au 2 août 2026, dans environ 36 jours. La bifurcation réglementaire US/UE est désormais structurelle, pas conjoncturelle : les startups internationales doivent choisir leur juridiction d’ancrage en fonction de leur produit, plus en fonction de leur fondateur.
Testez votre lecture de la semaine
Quelle est la fenêtre de contexte annoncée pour Gemini 2.5 Pro Deep Think ?
Combien de jours se sont écoulés entre le lancement de Claude Fable 5 et sa suspension par décret ?
Quel modèle open weights publié le 13 juin 2026 affiche 744 milliards de paramètres et un contexte de 1 million de tokens sous licence MIT ?
Sous quel nouveau nom Cognition a-t-il relancé l’IDE Windsurf le 2 juin 2026 ?
Quelle est la valorisation privée d’Anthropic au moment du dépôt d’IPO confidentiel en juin 2026 ?