IA, semaine du 16 au 23 juin : la souveraineté devient un produit
En sept jours, Washington a suspendu un modèle frontalière payant, ChatGPT est passé sous la barre des 50 % de part de marché, et NVIDIA s’est installé sur chaque couche du stack IA. La semaine confirme un basculement : la valeur ne se loge plus dans le modèle seul, mais dans la pile complète qui le rend disponible.
- Anthropic a suspendu Claude Fable 5 le 22 juin 2026 sous une directive d’export-control américaine, 13 jours après son lancement.
- ChatGPT tombe à 46,4 % de part de marché (vs 50 %+ en janvier), Gemini grimpe à 27,7 % avec 662 M d’utilisateurs mensuels.
- NVIDIA dévoile le RTX Spark Superchip pour PC, signe un deal techno de 20 Md$ avec Groq et finance sa levée de 650 M$.
- Anthropic dépose un S-1 confidentiel à 965 Md$ de valorisation et loue la totalité du datacenter Colossus 1 de xAI.
- L’open source chinois accélère : Kimi K2.7 Code (12 juin) et GLM-5.2 (13 juin) sortent en poids ouverts.
Fable 5 suspendu en 13 jours : l’export-control entre dans le produit
Anthropic a lancé Claude Fable 5 le 9 juin 2026, premier modèle de la classe Mythos rendu publiquement accessible via claude.ai Pro, Max et Team, avec un contexte d’un million de tokens et un prix de 10 $ en entrée et 50 $ en sortie par million de tokens. Le 22 juin, l’accès a été suspendu pour respecter une directive du gouvernement américain sur le contrôle des exportations. Aucun modèle frontalière n’avait jusqu’ici été bloqué aussi vite après un lancement payant.
Ce qui change n’est pas la règle — les contrôles d’export sur les puces et les modèles existent depuis 2022 — mais la vitesse d’exécution. Treize jours entre la mise en production et la coupure, c’est plus court que le cycle d’achat d’un SaaS B2B classique. Concrètement, un acheteur enterprise doit désormais traiter la résidence légale du fournisseur et l’origine du compute comme des critères au même niveau que la latence ou le prix au token.
L’effet immédiat se voit chez les clients européens et asiatiques : la série d’annonces dépasse la simple actualité produit. Elle valide une thèse que Mistral, DeepSeek et Moonshot poussent depuis 18 mois : la souveraineté d’un modèle est un argument commercial mesurable, pas un slogan de communiqué de presse.
ChatGPT sous 50 % : la guerre se joue désormais dans la distribution
Selon les chiffres publiés par First Page Sage et confirmés par TechCrunch le 16 juin 2026, ChatGPT est passé sous la barre des 50 % de part de marché pour la première fois. Le service d’OpenAI cumule 46,4 % fin mai, contre plus de 50 % en janvier, avec environ 1,1 milliard d’utilisateurs mensuels. Gemini grimpe à 27,7 % et 662 millions d’utilisateurs, soit une progression de 104 % sur six mois. Perplexity reste en dessous de 5 % et perd 18 % de visites web entre novembre 2025 et avril 2026.
La lecture du chiffre compte plus que le chiffre lui-même. ChatGPT n’a pas perdu d’utilisateurs, il en a même gagné. Mais Gemini est pré-installé sur Android, intégré à Workspace et poussé par défaut sur Pixel 11. La distribution mange la différentiation produit : même si le modèle sous-jacent reste légèrement en retrait sur certains benchmarks, l’exposition par défaut génère le volume.
Pour Perplexity, la situation est plus délicate. La marque garde un cas d’usage clair (recherche sourceée), mais la baisse de 18 % des visites suggère que la fonctionnalité a été absorbée par les modes « recherche profonde » de ChatGPT et Gemini. Le risque n’est pas une mort brutale : c’est une compression progressive de la base utile vers les 45 millions de power users déjà engagés.
NVIDIA s’installe sur chaque couche du stack
Le 1er juin 2026, NVIDIA a dévoilé le RTX Spark Superchip, une combinaison CPU+GPU basée sur Arm et fabriquée avec MediaTek, embarquée dans les PC Windows de Dell et Lenovo à l’automne. Le même jour, NVIDIA a annoncé un accord techno de 20 Md$ avec Groq pour intégrer la LPU Groq 3 à son catalogue GTC, pendant que Groq levait 650 M$ auprès d’investisseurs existants pour scaler son cloud d’inférence. Les actions d’AMD, Intel et Qualcomm ont reculé le jour de l’annonce.
La stratégie est lisible. Datacenter avec Blackwell et Vera, inférence accélérée avec Groq, PC grand public avec Spark. NVIDIA finance ses propres rivaux pour que la concurrence reste un fournisseur de sa propre roadmap. C’est la même logique qu’Apple imposant TSMC en exclusivité sur certaines générations : contrôler le levier industriel sans posséder toutes les usines.
Pour AMD, la lecture est plus dure. Les délais de livraison CPU atteignent six mois sur certains segments, les prix grimpent de plus de 10 % selon Reuters, et l’arrivée de Spark coupe l’axe de croissance laptop. Le terrain pratique pour les startups infra reste les niches où NVIDIA n’a pas encore industrialisé : orchestration multi-cloud, edge inference, et runtime locaux.
Anthropic dépose son S-1 et loue le datacenter de xAI
Anthropic a transmis à la SEC un projet de S-1 confidentiel le 1er juin 2026, après avoir clos sa série H le 28 mai à une valorisation post-money de 965 Md$ et avec un run-rate revenue annoncé à 47 Md$ en mai. La valorisation dépasse celle d’OpenAI (840 Md$ en février 2026), et l’IPO pourrait suivre celle de SpaceX (visée le 12 juin, 1 750 Md$ espérés, 75 Md$ à lever) et précéder celle d’OpenAI, attendue en septembre.
L’autre annonce, plus inattendue, concerne le compute. Anthropic a signé un accord pour utiliser la totalité de la capacité du datacenter Colossus 1 d’xAI au Tennessee : 300 MW et plus de 220 000 GPUs Nvidia. La rivalité publique entre Dario Amodei et Elon Musk ne déteint pas sur le bilan opérationnel. Quand la file d’attente compute est l’unique goulet d’étranglement, on loue au plus rapide, même s’il s’agit d’un concurrent direct sur la couche modèle.
Ce point a un effet d’industrie : il valide l’idée que la couche infrastructure devient un marché secondaire neutre, comparable au cloud du début des années 2010. Personne ne refuse une instance EC2 parce qu’Amazon vend aussi des livres.
L’open source pousse depuis la Chine et l’Europe
Moonshot AI a publié Kimi K2.7 Code et sa variante Highspeed le 12 juin 2026, en poids ouverts, avec une cible explicite : les agents de code. Le lendemain, Zhipu a sorti GLM-5.2, également en open weights et compétitif sur les benchmarks de raisonnement. Côté européen, Mistral Large 3 et Mistral Small 4 sont désormais disponibles sous licence Apache 2.0, ce qui leve la principale critique commerciale faite aux modèles précédents. Meta avait, de son côté, sorti Llama 4 Scout en avril (10 M tokens, single H100) et travaille sur Llama 5.
Le contraste avec le bloc propriétaire est nettement plus marqué qu’il y a six mois. Les benchmarks publics montrent que les meilleurs open weights chinois sont à 5–10 % des frontier propriétaires sur la plupart des tâches, avec un coût d’inférence parfois 30 % inférieur sur Groq ou vLLM. Pour la majorité des cas d’usage B2B (recherche interne, classification, extraction), cet écart est un détail de marge.
Le point pratique pour un décideur tech : avec Ollama, LM Studio ou Jan, l’arbitrage entre propriétaire et local-first se chiffre maintenant en heures de mise en place, plus en semaines. La barrière technique a fondu ; reste la barrière d’évaluation, qui demande une vraie méthodo d’eval.
Outils de code : Windsurf disparaît, Cursor segmente, Copilot bascule
Le 15 juin 2026, Cognition a finalisé le rebranding de Windsurf en Devin Desktop, le domaine windsurf.com redirige vers devin.ai. Cursor a restructuré ses plans Teams en juin : sièges Standard à 32 $ par mois sur facturation annuelle (40 $ en mensuel) et Premium à 96 $ pour 5 fois l’usage. GitHub Copilot a basculé le 1er juin vers une facturation usage-based avec un plan Max à 100 $. Côté Anthropic, Claude Code v2.1.169 (8 juin) a ajouté un mode --safe-mode qui restreint les actions destructrices en CLI.
Le mouvement de fond est la démonisation généralisée des sièges illimités. Les éditeurs facturent à l’usage parce que les agents consomment massivement plus de tokens que les complétions classiques. Sur un workflow agentique non encadré, un développeur peut brûler 50 $ de crédits API par jour sans avoir l’impression de coder davantage.
Le sujet pour les directions techniques est moins le choix d’outil que la mise en place d’observabilité des coûts par tâche. Un tableau de bord token/PR, token/test, token/issue commence à ressembler à ce qu’étaient les métriques CPU/mémoire en 2015 : invisibles tant que la facture passe, indispensables dès qu’elle accroche.
Testez votre lecture de la semaine
Combien de jours se sont écoulés entre le lancement de Claude Fable 5 et sa suspension par directive d’export-control ?
Quelle est la part de marché de ChatGPT fin mai 2026 selon First Page Sage ?
Quel est le montant du deal techno annoncé entre NVIDIA et Groq le 1er juin 2026 ?
Quelle capacité compute Anthropic a-t-il pris en location auprès d’xAI sur Colossus 1 ?
Lequel de ces modèles n’a PAS été publié en juin 2026 ?