Kimi K3 double Opus 4.8, SpaceX ferme Cursor : le frontier IA s'est reconfiguré en 7 jours
En sept jours, l'échelle open-weight a rattrapé Opus 4.8, SpaceX a bouclé Cursor pour 60 Md$, Meta a ouvert sa première API payante et l'EU AI Act est devenu contraignant. La carte du frontier IA n'est déjà plus la même.
- Kimi K3 (Moonshot) sort en 2,8 trillions de paramètres et se classe 4e mondial, devant Claude Opus 4.8.
- SpaceX finalise l'acquisition de Cursor à 60 Md$ et lance Grok 4.5 à 2 $/6 $ par million de tokens.
- Anthropic culmine à 47 Md$ d'ARR annualisé ; Andrej Karpathy rejoint le labo.
- Meta ouvre sa première API dev payante avec Muse Spark 1.1 (computer use natif, 1M contexte).
- L'EU AI Act est entré en application le 10 juillet 2026 avec des règles chatbot contraignantes.
Kimi K3, l'open-weight qui passe devant Opus 4.8
Le 16 juillet 2026, Moonshot AI a publié Kimi K3, un modèle Mixture-of-Experts totalisant 2,8 trillions de paramètres, avec seulement 16 experts actifs sur 896 par token, contexte 1 million de tokens, entrées texte, image et vidéo natives. Les poids complets seront disponibles le 27 juillet 2026. Sur le classement indépendant d'Artificial Analysis, Kimi K3 atteint la 4e place mondiale, devant Claude Opus 4.8 et derrière GPT-5.6 Sol et Claude Fable 5.
Ce résultat marque une rupture concrète : c'est la première fois qu'un modèle publié en poids ouverts dépasse un modèle propriétaire haut de gamme sur ce type de benchmark indépendant. La stratégie de Moonshot, adossée à l'écosystème chinois qui contourne les restrictions compute américaines, se traduit désormais par une pression tangible sur les frontier labs occidentaux. Question ouverte : combien d'équipes ont réellement l'infrastructure pour faire tourner un modèle 2,8 T en local ou en cluster interne ? La barrière ne sera plus la qualité du modèle mais le coût d'inférence par token servi. C'est un basculement du levier compétitif : du « meilleur modèle » vers « meilleur ratio qualité/coût déployé ».
SpaceX ferme Cursor, Grok 4.5 devient la démo du data flywheel
Le 8 juillet 2026, SpaceXAI a lancé Grok 4.5, premier modèle co-développé avec Cursor après la clôture effective de l'acquisition à 60 Md$. Le modèle repose sur l'architecture V9, un MoE de 1,5 trillion de paramètres entraîné sur des dizaines de milliers de GPU NVIDIA GB300. Point stratégique : Grok 4.5 a été entraîné sur des données Cursor, soit des millions de sessions réelles de développement (revues de code, debug, edits inline, chaînes de raisonnement dev). Prix : 2 dollars par million de tokens input, 6 dollars output, soit sensiblement en dessous des concurrents propriétaires. Non disponible dans l'UE au lancement.
L'événement acte deux choses. Un : la donnée de développement propriétaire devient un actif stratégique de même niveau que le compute. Deux : SpaceX verrouille verticalement modèle + IDE + agent + supply chain compute. Windsurf a disparu dans le mouvement de recomposition. Pour les startups SaaS, la lecture inconfortable est claire : le prochain moat n'est ni le prompt ni le workflow, mais l'accès aux traces d'usage réelles.
Anthropic à 47 Md$ d'ARR, la course des revenus contre la course du buzz
Anthropic s'est discrètement installé en tête du secteur sur un critère qui compte : le chiffre d'affaires. L'ARR annualisé du labo atteint désormais environ 47 Md$, avec une rentabilité opérationnelle rapportée en 2026. Cette semaine, Andrej Karpathy a officialisé son arrivée chez Anthropic pour travailler sur la R&D frontier. Le labo a également publié une avancée d'interprétabilité (la technique J-lens) : un sous-espace interne d'environ 25 concepts actifs, représentant moins de 10% de la variance d'activation, se comporte comme le « global workspace » identifié en neurosciences de la conscience. L'ablation de ce sous-espace fait s'effondrer le raisonnement multi-étapes tout en préservant la fluidité linguistique.
La lecture stratégique est intéressante : pendant qu'OpenAI oriente sa communication grand public vers l'IPO, Anthropic capitalise le B2B avec méthode. Deux stratégies opposées, deux thèses sur la valeur long terme. Question ouverte : le leadership revenus se convertit-il en leadership perception dans les 12 prochains mois ?
Meta arrête le tout-gratuit avec Muse Spark 1.1
Le 9 juillet 2026, Meta a publié Muse Spark 1.1, un modèle agentic 1 million de tokens de contexte, positionné en concurrence directe de GPT-5.5 et Claude Opus 4.8 sur les évaluations agentic. Le modèle intègre nativement le computer use (contrôle desktop, browser, mobile) et la délégation à des subagents en parallèle. Point clé : Muse Spark 1.1 embarque la toute première API dev payante de Meta AI, avec 20 dollars de crédits offerts au lancement, réservée aux États-Unis en preview publique.
C'est un basculement doctrinal. Pendant des années, Meta a cadré son offre IA autour de Llama en open-weight, en faisant du « tout gratuit » son argument différenciant. Le lancement d'une API payante avec computer use suggère que Meta a compris que la valeur ne se joue plus sur les poids mais sur l'infrastructure d'orchestration agentique. Pour les équipes qui construisent sur des agents, c'est un fournisseur supplémentaire à évaluer sérieusement, avec un rapport prix/perf encore inconnu jusqu'aux premiers benchmarks indépendants.
OpenAI prépare son IPO, GPT-5.6 sort en trois tailles
OpenAI a lancé GPT-5.6 en trois variantes : Luna (rapide), Terra (qualité GPT-5.5 à moitié prix) et Sol (flagship avec mode Ultra subagent et effort de raisonnement Max). Tarification : de 1 à 5 dollars par million de tokens input, contexte 1 million de tokens, connaissance à février 2026. En parallèle, OpenAI a lancé GPT-Live, un modèle vocal qui décide plusieurs fois par seconde s'il doit parler, se taire, interrompre ou appeler un outil, avec délégation dynamique à GPT-5.5 sur les requêtes complexes. Neuf voix remasterisées, wake word « Hey Chat », traduction temps réel.
Sur le plan capitalistique, OpenAI prépare un dépôt confidentiel d'introduction en bourse dans les prochaines semaines, avec Goldman Sachs et Morgan Stanley comme banques conseils, ciblant une IPO potentielle en septembre 2026. Le contraste avec la stratégie Anthropic est net : OpenAI joue la visibilité produit et la sortie boursière, Anthropic joue les marges B2B silencieuses. Les deux thèses ne sont pas mutuellement exclusives, mais elles impliquent des trade-offs différents sur la vitesse d'expansion, le contrôle de la roadmap et la sensibilité aux cycles du marché.
NVIDIA Groq 3 LPX, la nouvelle configuration de l'infra
À GTC 2026, NVIDIA a présenté le rack Groq 3 LPX, composé de 128 LPU (Language Processing Units) issus de la licence technologique signée avec Groq en décembre 2025 dans le cadre d'un deal à 20 Md$. Combiné avec le rack Vera Rubin NVL72, NVIDIA annonce un gain de 35 fois le throughput par mégawatt et 10 fois plus d'opportunité de revenu. Groq a également levé 650 M$ post-licence pour financer l'expansion de son cloud d'inférence.
Deux signaux dans cette configuration. Un : NVIDIA reconnaît explicitement que l'ère du GPU générique se termine, l'inférence se sépare de l'entraînement et demande du silicium dédié. Deux : Groq, qui aurait pu devenir un concurrent frontal, a été absorbé dans l'écosystème NVIDIA par licence et par hires (Jonathan Ross et l'équipe sénior chez NVIDIA). Pour les équipes qui déploient de l'inférence à grande échelle, la stratégie compute doit désormais séparer deux couches : silicium optimisé pour entraînement et silicium optimisé pour inférence. Le prix par token servi va continuer à baisser plus vite qu'anticipé.
EU AI Act, phase 1 en vigueur depuis le 10 juillet 2026
Depuis le 10 juillet 2026, les règles de divulgation obligatoire pour les chatbots imposées par le EU AI Act sont juridiquement contraignantes. Le paquet Digital Omnibus adopté le 9 juillet a consolidé le calendrier d'application, confirmant l'entrée en vigueur des règles High-Risk le 2 août 2026 et le cadre procédural pour les autorités nationales. Le plan d'action Cybersécurité et IA publié en juillet formalise l'approche coordonnée pour aider les États membres à gérer les risques posés par les modèles les plus avancés.
À noter : Grok 4.5 n'est pas encore disponible dans l'UE. Cette abstention est un signal politique autant que technique. Les frontier labs commencent à arbitrer explicitement entre exposition au marché européen et coût de conformité. Pour les entreprises européennes, la conséquence directe est un accès potentiellement retardé aux modèles les plus récents, avec un effet de rattrapage à venir sur l'infra locale et les fournisseurs comme Mistral, positionnés comme les alternatives conformes par défaut. Le pari européen sur le couple régulation-innovation reste incertain à 12 mois.
Testez votre lecture de la semaine
Sur quel classement indépendant Kimi K3 se positionne-t-il 4e mondial ?
À combien SpaceX a-t-elle valorisé Cursor lors de l'acquisition clôturée en juillet 2026 ?
Quel est l'ARR annualisé rapporté d'Anthropic en 2026 ?
Quelle est la caractéristique commerciale nouvelle apportée par Muse Spark 1.1 ?
Depuis quelle date les règles de divulgation chatbot de l'EU AI Act sont-elles contraignantes ?