45 milliards, Siri sous Gemini et Windsurf rebaptisé : la semaine qui rebat l'IA
L'IA s'industrialise dans tous les sens en même temps. Apple choisit de la sous-traiter, Anthropic la loue par camions entiers, NVIDIA descend sur le PC. La pile se désintègre par le haut et par le bas pendant que les outils dev consolident violemment.
- Apple intègre Gemini par défaut dans Siri et ouvre iOS 27 à Claude et ChatGPT pour la première fois.
- Anthropic signe 45 Md$ cumulés avec SpaceX pour Colossus 1, soit 1,25 Md$ par mois jusqu'en mai 2029.
- xAI sort Grok Voice et Grok Imagine 1.5, et boucle l'entraînement de Grok V9-Medium à 1,5 Bn de paramètres.
- NVIDIA dévoile le RTX Spark Superchip pour PC Windows et fait reculer AMD, Intel et Qualcomm en Bourse.
- Mistral renomme Le Chat en Vibe, Cursor restructure son pricing Teams, Cognition retire la marque Windsurf.
WWDC 2026 : Apple sous-traite officiellement son IA
Le 9 juin 2026, Tim Cook a tenu sa dernière keynote en présentant un Siri reconstruit autour de Gemini par défaut, avec un nouveau système d'AI Extensions qui permet pour la première fois aux utilisateurs d'iOS 27 de basculer sur Claude ou ChatGPT comme moteur d'Apple Intelligence. C'est un aveu stratégique : Apple n'a pas rattrapé le retard sur les frontier labs et a décidé d'en faire une caractéristique produit plutôt qu'un échec.
Tous les iPhones depuis l'iPhone 11 sont éligibles à la mise à jour, Apple annonce un chargement des photos 70% plus rapide et des transferts AirDrop 80% plus rapides. Le moteur conversationnel est livré clés en main par Google, mais Apple garde la couche d'orchestration : c'est elle qui décide quel modèle reçoit quelle requête.
Pour Anthropic, c'est un nouveau canal de distribution sur des centaines de millions d'appareils, sans avoir à vendre un seul abonnement Claude.ai. Pour Google, c'est la deuxième revanche de l'année après la victoire sur le procès antitrust. John Ternus, qui succède à Cook au 1er septembre 2026, hérite d'une plateforme où l'IA est un marché biface plutôt qu'un produit propriétaire.
1,25 milliard par mois : Anthropic loue le silicium de SpaceX
Les documents IPO de SpaceX déposés la semaine du 2 juin 2026 l'ont confirmé : Anthropic versera 1,25 Md$ par mois à SpaceX jusqu'en mai 2029, soit environ 45 Md$ cumulés, pour la totalité de la capacité du datacenter Colossus 1 au Tennessee. Plus de 300 MW et 220 000 GPU NVIDIA basculent côté Claude.
Conséquence immédiate pour les utilisateurs : Anthropic a doublé les limites 5 h pour les abonnés Pro, Max, Team et Enterprise, et a augmenté les quotas API Tier 1 de 1 500% en tokens d'entrée et de 900% en tokens de sortie. Le goût amère : Anthropic, qui martelait son indépendance vis-à-vis des hyperscalers, devient client captève d'un fournisseur infrastructure dirigé par Elon Musk, lui-même actionnaire majoritaire de xAI, concurrent direct de Claude.
La question stratégique pour le secteur : si le coût compute d'un labo frontier atteint 15 Md$ par an avant marketing, formation et inférence grand public, combien de labos peuvent tenir cette échelle ? La réponse 2026 ressemble à quatre ou cinq, pas dix. Le reste passera par le compute à la location ou par l'open source déployé sur des runtimes locaux comme vLLM, llama.cpp ou MLX.
xAI accèlère pendant que Cognition rebat ses cartes
Le 4 juin 2026, xAI a livré Grok Voice et Grok Imagine 1.5 Preview en même temps, dont une mise à disposition immédiate via API. Le 5 juin, Musk a annoncé que Grok V9-Medium, à 1,5 Bn de paramètres, a terminé son entraînement, sortie publique visée mi-juin. Le 9 juin, Bloomberg a révélé la nomination de Jack Galabedian, ex-ingénieur Starlink, à la tête du training team de Grok.
Pendant ce temps, le 2 juin, Cognition a discrètement retiré la marque Windsurf et a relancé l'IDE sous le nom Devin Desktop, avec l'Agent Command Center comme surface par défaut et le support du protocole ouvert ACP. C'est la troisième consolidation majeure du marché des IDE IA en six mois, après le repositionnement de Kiro et la sortie d'Antigravity 2.0 par Google.
Le constat : sept acteurs sérieux se disputent encore le même développeur, à savoir Claude Code, Cursor, GitHub Copilot, OpenAI Codex, Antigravity, Kiro et Devin Desktop. La rationalisation interviendra dans les douze mois et trois noms tiendront, pas sept. Pour un développeur, la décision n'est plus « quel outil est le meilleur » mais « lequel survivra assez longtemps pour amortir mes raccourcis ».
Mistral mue, Cursor restructure, Copilot bascule à l'usage
Fin mai 2026, Mistral a rebaptisé Le Chat en Vibe et a ajouté trois capacités structurantes : Work Mode pour les tâches longue durée multi-outils, Code Mode pour des agents de code distants, et une extension VS Code Mistral Vibe. La preview publique de Workflows complète le tableau avec une orchestration durable et observable déployable on-prem, cloud ou hybride. L'Europe récupère enfin un assistant agentique de bout en bout sous licence Apache 2.0 sur ses modèles ouverts.
Côté outils dev, Cursor a restructuré ses Teams en sièges Standard à 32$/mois/siège annuel et Premium à 96$/mois/siège annuel avec un quota usage multiplié par cinq, fin déclarée des sentiments de surprise sur la facture. Le 1er juin 2026, GitHub Copilot a basculé vers un modèle de facturation à l'usage avec un plan Max 100$/mois, marquant la fin de l'année du forfait illimité dans les IDE.
Lecture transversale : les trois acteurs réagissent au même problème, l'inférence agentique coûte plus cher que ce que tolère un forfait fixe. Le modèle économique des assistants de code se rapproche de celui du cloud, soit pay-per-use avec garde-fous. Pour les équipes, la conversation budgétaire change : on n'achète plus un outil, on rationne du compute.
NVIDIA descend sur le PC : AMD et Intel sous pression
Le 1er juin 2026, NVIDIA a dévoilé le RTX Spark Superchip pour PC Windows, première incursion frontale du fondeur sur le marché des puces grand public depuis ses Tegra mobiles. Les premiers laptops Dell et Lenovo arriveront à l'automne. Le même jour, les titres AMD, Intel et Qualcomm ont décroché en séance.
Le mouvement s'inscrit dans la stratégie dévoilée à GTC 2026 avec le Groq 3 LPX, un rack de 128 LPU dédiés à l'inférence, et le CPU Vera Rubin NVL72 qui revendique un débit 35× supérieur par mégawatt et 10× de revenus potentiels par rapport à la génération précédente. NVIDIA détient désormais GPU, LPU, CPU datacenter et puces PC, soit le seul fondeur capable d'aligner verticalement toute la pile.
Pour AMD, qui finissait de digerer son rachat d'un fournisseur d'inférence en mars, la riposte est urgente. Pour Intel, la question est plus existentielle : la division foundry n'a toujours pas de client frontier, et le segment PC commodifié sera disputé sur le terrain même où NVIDIA avance avec une marge brute de 75% sur le datacenter. Sur l'année fiscale en cours, le consensus des analystes intègre déjà un recul des parts AMD de quatre points sur le datacenter et de deux points sur le client PC.
Open source : Qwen, DeepSeek, Llama et Mistral gardent le rythme
Pendant que les frontier labs propriétaires se livrent au théâtre infrastructurel, l'open source continue de combler l'écart. Qwen 3.5, publié en février 2026, atteint 397 Md de paramètres totaux avec 17 Md actifs par passage, supporte 201 langues et un contexte de 1 M tokens. DeepSeek V4 Pro a livré en avril 2026 sous licence MIT un score de 80,6% sur SWE-bench Verified. Kimi K2.6 atteint 58,6% sur SWE-bench Pro, devant tous les modèles frontier fermés payés. Mistral Large 3 reste sous Apache 2.0 sans plafond utilisateur.
Côté runtimes, mai 2026 a été le mois le plus dense de l'année. Ollama est passé de la 0.23.0 à la 0.24.0 en onze jours, avec support de Codex App, speculative decoding MTP via le runner MLX et latence /api/show divisée par 6,7. vLLM v0.21.0 a stabilisé DeepSeek V4 sur Blackwell, et la v0.22.0 attendue corrigera la dérive d'attention en long contexte avec EAGLE 3.1. llama.cpp et LM Studio ont mergié MTP, MLX gagne 4× sur M5.
Conséquence pratique : un développeur peut faire tourner un modèle de niveau Claude Sonnet 4.6 sur un Mac Studio M5 Max avec 128 Go de RAM pour zero coût marginal et sans envoyer une seule requête à l'extérieur. Le calcul cloud contre local penche à l'avantage du local dès 80 000 requêtes mensuelles.
Robotique LLM-native et réglementation européenne
Boston Dynamics, Google Cloud et DeepMind ont annoncé en juin 2026 l'intégration de Gemini Robotics-ER 1.6 dans Spot et la plateforme d'inspection visuelle Orbit AI. Le robot quadrupède raisonne désormais sur l'espace qu'il perçoit, prend des décisions autonomes en environnement industriel complexe et apprend en continu. C'est l'illustration la plus visible du passage de la robotique pré-programmée à la robotique LLM-native.
Sur le plan réglementaire, le Code de pratique sur le marquage des contenus générés par IA est attendu d'ici fin juin 2026 coté Commission européenne. Cela prépare l'entrée en application complète de l'AI Act le 2 août 2026, avec des obligations renforcées sur les modèles à usage général. Le 1er juin, la Commission a annoncé un mécanisme de support d'experts indépendants pour aider à l'application.
Lecture européenne : Mistral en France et SAP en Allemagne se positionnent comme alternatives souveraines à pousser commercialement au moment où Apple, NVIDIA et Anthropic concentrent encore plus de pouvoir américain. La fenêtre est mince, le calendrier réglementaire dicte le tempo. Si l'industrie européenne ne répond pas avant la fin de l'année, le marché sera durablement structuré par les acteurs hors UE.
Testez votre lecture de la semaine
Quel modèle devient l'assistant Siri par défaut dans iOS 27 ?
Combien Anthropic paie chaque mois à SpaceX pour la capacité Colossus 1 ?
Sous quel nom Cognition relance l'ex-Windsurf ?
Quel fondeur entre frontalement sur le PC Windows avec un Superchip dédié ?
Quelle taille a Grok V9-Medium dont xAI a bouclé l'entraînement le 5 juin 2026 ?