Anthropic passe devant OpenAI à 965 Md$: la semaine où la course IA a changé d’échelle
Cap table contre cap table, Bruxelles qui recule, talents qui désertent Google, modèles chinois à 0,2 point des leaders propriétaires: la semaine du 26 juin 2026 acte un basculement structurel de l’écosystème IA, sur cinq fronts à la fois.
- Anthropic clôt sa Series H à 965 Md$ post-money et dépose un S-1 confidentiel, passant devant OpenAI (852 Md$).
- OpenAI a lui-même filé son S-1 à la SEC le 8 juin 2026, ouvrant l’IPO supercycle IA.
- Le Parlement européen reporte de 16 mois les obligations high-risk de l’Annexe III: cibles décalées au 2 décembre 2027.
- L’open weight chinois (DeepSeek V4-Pro, MiniMax M3, GLM-5.2, Kimi K2.7) recolle à moins de 1 point des leaders fermés.
- NVIDIA intègre Groq dans le rack Vera Rubin NVL72 (35× débit/MW), pendant que Groq lève 650 M$ en parallèle.
Anthropic prend la tête en valorisation, OpenAI suit avec son S-1
Le bouleversement de la semaine ne se joue pas sur un benchmark, il se joue sur un cap table. Anthropic a confirmé la clôture d’une Series H à 965 Md$ post-money à la fin du mois de mai 2026, puis déposé dans la foulée un S-1 confidentiel auprès de la SEC. Le laboratoire passe ainsi devant OpenAI, dont la dernière levée privée en mars 2026 valorisait le groupe à 852 Md$. C’est la première fois depuis la fondation d’Anthropic en 2021 que la maison mère de Claude dépasse celle de ChatGPT sur le marché privé.
OpenAI n’est pas en reste. Le 8 juin 2026, Sam Altman a fait déposer un S-1 confidentiel auprès de la SEC, ouvrant officiellement le calendrier d’une introduction en bourse attendue depuis près de deux ans. Les deux dossiers tomberont donc en parallèle devant la régulation américaine, ce qui va mécaniquement comparer la base d’ARR, la marge brute d’inférence et la dépendance client. Aucune des deux entreprises n’a publié ses agrégats, mais le simple alignement des deux S-1 en juin–juillet va forcer une transparence inédite sur l’économie unitaire des frontier labs.
L’effet de second tour est macro. Le secteur IA a capturé 242 Md$ sur les 300 Md$ levés par les startups dans le monde au premier trimestre 2026, soit 80% du venture global. 88% de cette enveloppe est allée à des sociétés américaines. Cerebras a listé le 14 mai 2026, SpaceX a commencé son roadshow le 8 juin. L’IPO supercycle IA démarre maintenant.
La fuite des cerveaux quitte Google pour les pure-players
Le 24 juin 2026, TechCrunch a confirmé trois départs simultanés qui font date chez Google DeepMind. Noam Shazeer, co-auteur du papier fondateur « Attention Is All You Need » (2017) qui a introduit l’architecture Transformer, quitte Google pour rejoindre OpenAI. Le même jour, le directeur DeepMind John Jumper, prix Nobel de chimie 2024 pour AlphaFold, a annoncé son départ vers Anthropic. Jonas Adler et Alexander Pritzel, contributeurs clés de Gemini, le suivent également chez Anthropic.
Le pattern est sans équivoque: les talents fondateurs partent des hyperscalers vers les pure-players IA. La raison n’est ni le salaire de base ni l’equity nominal, c’est la vitesse d’exécution et l’optionalité d’IPO à horizon 18 mois. Anthropic et OpenAI offrent une trajectoire de liquidité concrète avec leurs S-1, là où Alphabet allonge les cycles décisionnels et arbitre constamment entre Search, YouTube, Cloud et DeepMind.
Conséquence immédiate sur la roadmap produit. Gemini 3.5 Flash est devenu le modèle par défaut de l’app Gemini et de l’AI Mode du Search depuis le 19 mai 2026, et Sundar Pichai a publićement repoussé Gemini 3.5 Pro à « un mois supplémentaire ». Ces deux nouvelles, lues ensemble, expliquent pourquoi le marché privé salarie désormais Anthropic comme la valeur de croissance et Google comme la valeur de cash flow. La dynamique n’est plus la même.
L’AI Act européen recule de 16 mois sur le high-risk
Le 16 juin 2026, le Parlement européen a voté le Digital Omnibus, paquet d’amendements qui modifie en profondeur le calendrier de l’AI Act. La principale décision: les obligations applicables aux systèmes high-risk autonomes listés à l’Annexe III sont reportées au 2 décembre 2027, au lieu du 2 août 2026 initialement prévu. Soit un décalage net de 16 mois sur ce qui constituait le cœur opérationnel du texte.
L’Article 50, qui exige qu’un utilisateur sache lorsqu’il interagit avec une IA, reste applicable au 2 août 2026. La Commission a parallèlement publié le 10 juin 2026 le Code de bonne pratique sur la transparence des contenus générés par IA, un cadre volontaire qui précise comment marquer ces sorties. Le 1er juin 2026, elle a nommé un panel scientifique de 60 membres pour appuyer l’AI Office sur les questions GPAI.
Lecture politique: Bruxelles cède du terrain sous pression industrielle, mais ne renie pas sa doctrine. Le texte garde sa structure, ses catégories et son régime de sanctions. Ce qui change, c’est le rythme d’application, pour donner du temps aux fournisseurs de GPAI européens (Mistral notamment) et éviter de bloquer les RH internes des PME au moment où le pipeline d’agents productifs commence à ruisseler. Pour un SaaS B2B vendu en Europe, la chaîne d’exigences ne saute pas; elle décale.
L’open weight chinois recolle à moins d’un point des leaders
Juin 2026 acte une nouvelle phase pour l’open weight. DeepSeek V4-Pro atteint 80,6% sur SWE-bench Verified, soit 0,2 point seulement derrière Claude Opus 4.6, sous licence MIT. MiniMax M3 sort en open weight avec 1M de contexte, multimodalité native et 59,0% sur SWE-Bench Pro, devenant le modèle ouvert le plus haut du leaderboard agentique. Z.ai publie GLM-5.2, gains substantiels coding et agentic vs 5.1, intégré dans Hermes Agent (Nous Research) en quelques jours. Moonshot pousse Kimi K2.7 Code HighSpeed, qui revendique 6× le throughput multimodal de la version 2.6.
L’architecture sous-jacente converge. Les flagships open weight sont désormais quasi tous Mixture-of-Experts: DeepSeek V4-Pro (1,6 T totaux pour 49 Md actifs), Llama 4 Maverick (400 Md / 17 Md actifs), Qwen 3.5 (397 Md / 17 Md), Mistral Large 3 (675 Md / 41 Md). Mistral a basćulé Large 3 et Small 4 sous Apache 2.0, un revirement majeur de licence par rapport à sa période 2024.
Le moat des frontier labs fermés ne tient désormais plus sur la performance brute, mais sur l’UX et la verticalisation (Claude Code, ChatGPT app, Antigravity). C’est pourquoi les valorisations Anthropic et OpenAI continuent à gonfler pendant que les courbes de perf ouvrent / fermé se chevauchent. La différenciation se réinvente une fois par trimestre.
La pile dev IA se recompose autour de protocoles ouverts
Le 2 juin 2026, Windsurf a été rebrandé en Devin Desktop, avec l’Agent Command Center comme surface par défaut et le support natif de l’Agent Client Protocol (ACP). Trois jours plus tard, Cursor a restructuré son pricing Teams: 32$ par poste en annuel pour le Standard, 96$ par poste en annuel pour le Premium. Le 1er juin, GitHub Copilot a activé le flex billing usage-based et introduit un plan Max à 100$ par mois. Google a relancé Antigravity en version 2.0, suite multi-agents avec Gemini 3.5 Flash par défaut.
Côté agents pures, OpenCode est devenu en juin 2026 l’agent open-source le plus adopté, avec plus de 160 000 stars GitHub et 7,5 millions de MAU. Sur Terminal-Bench, Codex avec GPT-5.5 domine à 83,4%, suivi de Claude Code avec Fable 5 à 83,1%. Six benchmarks comptent réellement pour des décisions d’achat (GAIA, SWE-Bench Verified, OSWorld, Tau-Bench, WebArena, METR HCAST).
La conclusion opérationnelle est nette. La pile dev IA ne se choisit plus par fournisseur unique mais par protocole. ACP, MCP et le partage de contexte entre Cursor, Claude Code, Codex et Devin Desktop définissent une orchestration multi-outils, où chaque agent garde son IDE de prédilection. Le coût mensuel par développeur sérieux a explosé (200–400$ avec deux outils), mais le ratio productivité reste favorable.
NVIDIA absorbe Groq dans son rack, Groq lève quand même
NVIDIA a révélé durant GTC 2026 l’intégration de Groq 3 LPX dans son rack Vera Rubin NVL72, combinant 128 LPU Groq par rack pour un débit annoncé de 35× supérieur par mégawatt par rapport à l’architecture précédente, et un revenue opportunity multiplié par dix. La transaction sous-jacente, qualifiée de « not-acqui-hire » par TechCrunch en mai 2026, représente 20 Md$ versés par NVIDIA pour accéder à la pile LPU et à ses ingénieurs, sans rachat formel.
Groq garde son autonomie corporate et lève en parallèle 650 M$ auprès de ses investisseurs existants pour financer son neocloud d’inférence. La société conserve donc une trajectoire de standalone, même si NVIDIA capture l’essentiel de l’upside hardware. Pour les hyperscalers AWS, Azure et GCP, le signal est clair: l’armée GPU NVIDIA désormais flanquée d’une couche LPU spécialisée en inférence creuse l’écart technique sur le throughput par watt.
Effet de bord, NVIDIA entre dans le PC. Le RTX Spark Superchip, co-développé avec MediaTek pour Windows on Arm, sera embarqué dans des laptops Dell et Lenovo à partir de l’automne 2026. L’annonce, le 1er juin, a fait reculer les actions Intel, AMD et Qualcomm le même jour. La stratégie de Jensen Huang est lisible: couvrir chaque couche de la pile, du chip serveur au chip laptop, en passant par le LPU d’inférence.
Suspension des modèles Anthropic Fable 5 et Mythos 5
Le 12 juin 2026, Anthropic a suspendu l’accès à Claude Fable 5 et Claude Mythos 5 pour l’ensemble de ses clients, en application d’une directive d’export control du gouvernement américain. C’est la première fois qu’une réglementation US bloque directement la disponibilité grand public de modèles frontier, et non simplement leur export vers certaines géographies sensibles. Claude Mythos 5 était, depuis le 9 juin, le premier modèle Mythos-class accessible publiquement.
L’onde de choc dépasse Anthropic. La même règle pourrait s’appliquer demain à GPT-5.5 ou Gemini 3.5 Pro si leur classification évolue. Pour un acheteur entreprise européen, la dépendance unique à un fournisseur US devient un risque opérationnel chiffrable: une coupure unilatérale peut intervenir sans préavis ni canal d’appel. C’est précisément ce que le DPO craint quand il bloque les contrats data residency.
Conséquence immédiate sur les choix d’architecture. Le hedge multi-modèles redevient une exigence et non un luxe. Une base de code agentique en juin 2026 doit pouvoir basculer en moins de 24 heures entre Claude Opus 4.6, GPT-5.5, Gemini 3.5 et un fallback open weight (DeepSeek V4-Pro, MiniMax M3, Mistral Large 3). Les couches d’abstraction type LiteLLM, Helicone ou Portkey deviennent des choix défensifs critiques, pas des commodités techniques.
Testez votre lecture de la semaine
Quelle valorisation Anthropic affiche-t-il après sa Series H clôturée fin mai 2026 ?
Le 16 juin 2026, le Parlement européen a :
Quel modèle open-weight atteint 59,0% sur SWE-Bench Pro en juin 2026 ?
Quel co-auteur d’« Attention Is All You Need » quitte Google pour OpenAI ?
Combien NVIDIA a-t-il décaiśé pour accéder à la techno LPU de Groq (not-acqui-hire) ?