Trois flagships IA en dix jours : GPT-5.6, Muse Spark 1.1 et Sonnet 5 rebattent les cartes
Entre le 30 juin et le 11 juillet 2026, trois frontier labs ont livré un modèle majeur. Le marché se stratifie : plus de modèle unique à tout faire, mais des gammes à trois vitesses où le prix devient un levier d’architecture.
- Le 9 juillet, OpenAI ouvre GPT-5.6 en trois tiers (Sol, Terra, Luna) et lance ChatGPT Work, un agent qui exécute des jobs entiers.
- Le même jour, Meta livre Muse Spark 1.1 (contexte 1M tokens, computer use natif) et son premier API payant à 1,25 $ / 4,25 $ par million de tokens.
- Anthropic pousse Sonnet 5 à 2 $ / 10 $ jusqu’au 31 août et libère l’Auto Mode de Claude Code sur Bedrock, Vertex et Foundry le 11 juillet.
- Côté open source, GLM-5.2 et Kimi K2.7 Code tiennent la cadence des labos chinois. L’écart avec le propriétaire se resserre.
- Le 2 août, l’EU AI Act active l’article 50 (transparence) et les pouvoirs de sanction sur les GPAI providers.
Le week-end du 9 juillet : trois labos, une même fenêtre de tir
Rarement une semaine aura vu autant de modèles frontier sortir en aussi peu de temps. Le 30 juin, Anthropic livre Sonnet 5. Le 1er juillet, Fable 5 revient globalement après la levée des export controls US du 12 juin. Puis, le 9 juillet, deux annonces le même jour : OpenAI ouvre GPT-5.6 à 17h02 UTC et Meta pousse Muse Spark 1.1. En moins de dix jours, le paysage des modèles phares a été entièrement recomposé.
Ce télescopage n’est pas fortuit. L’EU AI Act franchit le 2 août une étape d’exécution majeure : l’article 50 sur la transparence entre en vigueur et la Commission gagne ses pouvoirs de sanction sur les GPAI providers. Sortir un nouveau flagship avant la fenêtre réglementaire permet de figer les documentations, les model cards et les red-teaming reports avant que les auditeurs européens n’arrivent. Trois semaines séparent Muse Spark 1.1 de l’activation des sanctions.
Pour l’utilisateur, la conséquence est un choix qui n’a jamais été aussi fragmenté. Le marché, mesuré par Momentic en juillet, reste dominé par ChatGPT (53,9% des visites web mondiales), suivi de Gemini (27,9%), Claude (9,2%), Grok (2,4%) et Perplexity (1,3%). Mais côté API et intégration produit, la donne est bien plus équilibrée.
GPT-5.6 Sol, Terra, Luna : OpenAI stratifie enfin sa gamme
OpenAI ne vend plus « GPT-5 » comme un modèle mais comme une gamme à trois étages. Sol est le flagship, avec un nouveau mode Ultra subagent et un réglage Max reasoning-effort, facturé 5 $ input / 30 $ output par million de tokens. Terra cible la qualité d’un GPT-5.5 à moitié prix, soit 2,50 $ / 15 $. Luna est le tier rapide et bon marché à 1 $ / 6 $. Sol tourne aussi sur Cerebras à 750 tokens par seconde, ce qui, pour une charge agentique, change complètement l’équation de latence.
Autour du modèle, OpenAI a lancé ChatGPT Work, un agent conçu pour exécuter des jobs entiers plutôt que répondre à des questions. C’est là le vrai virage : le prompt rétrécit, la mission s’élargit. La preview GPT-5.6 avait été réservée à environ 20 organisations validées par le Commerce Department depuis le 26 juin, un review inhabituel qui préfigure la doctrine d’export controls US étendue aux modèles frontier.
Meta Muse Spark 1.1 : Zuckerberg vend des tokens
Meta Superintelligence Labs a livré le 9 juillet Muse Spark 1.1, sa deuxième itération après la version d’avril. Le modèle apporte trois choses lourdes : un contexte 1M tokens géré activement, du computer use natif (desktop, navigateur, mobile) et l’ouverture du Meta Model API en preview publique aux développeurs américains. C’est la première fois que Meta facture directement pour l’accès à un modèle. Le prix : 1,25 $ input / 4,25 $ output par million de tokens, avec 20 $ de crédit offerts.
Sur les benchmarks, le score sur MCP Atlas atteint 88,1, devant Claude Opus 4.8 et GPT-5.5. Sur JobBench, qui mesure l’usage professionnel d’outils, Muse Spark 1.1 sort à 54,7 contre 48,4 pour Opus 4.8 et 38,3 pour GPT-5.5. La faiblesse est sur Terminal-Bench 2.0 : 59,0, en dessous des 82,7 de GPT-5.5 et des 65,4 d’Opus 4.8. Autrement dit, Muse Spark 1.1 est un très bon agent généraliste, moins un très bon développeur.
Sonnet 5, Fable 5 et Claude Code : Anthropic joue le prix agressif
Anthropic a sorti Sonnet 5 le 30 juin, positionné comme un modèle mid-tier proche des performances d’Opus 4.8. La tarification de lancement est agressive : 2 $ input / 10 $ output par million de tokens jusqu’au 31 août. Face à Terra (2,50 $ / 15 $) et Muse Spark 1.1 (1,25 $ / 4,25 $), Sonnet 5 est le meilleur ratio qualité-prix perceptible sur la tranche intermédiaire, tant que la promo dure. Le 1er juillet, Fable 5 est revenu globalement après la levée des export controls US.
Le 11 juillet, Product Claude Code a débloqué l’Auto Mode par défaut sur Bedrock, Vertex AI et Foundry. La variable CLAUDE_CODE_ENABLE_AUTO_MODE disparaît, ce qui signale une chose : Anthropic considère son orchestration d’agents assez mûre pour ne plus être gardée derrière un flag. Pour les équipes IT sur clouds enterprise, l’adoption devient un choix produit et non plus un opt-in technique.
La guerre des devs : Cursor découple, SpaceX paie 60 milliards
Le 9 juillet, Cursor a découplé ses seats Teams en deux pools distincts : un pour Composer et Auto (les modèles first-party Cursor), un autre pour les modèles tiers (Claude, GPT, Gemini). Le message business est limpide : les seats sont subventionnés tant que vous utilisez les modèles maison. Ce découplage arrive dans un contexte particulier : Acquisition le 16 juin, SpaceX a annoncé l’acquisition d’Anysphere pour 60 Md$ en all-stock, la plus grosse acquisition de startup VC de l’histoire.
Le marché a répondu brutalement : en quatre jours de trading suivant l’annonce, la capitalisation de SpaceX a perdu environ 600 Md$, soit dix fois la valeur du deal lui-même. Cursor pesait pourtant 2,6 Md$ d’ARR annualisé. L’interprétation la plus honnête : les investisseurs ne voient pas de synergies plausibles entre une entreprise de lanceurs et un IDE, et sanctionnent le signal que la trajectoire capitalistique de SpaceX devient imprévisible. L’autre lecture concerne Anthropic, OpenAI et Google : 43% du financement VC mondial du premier semestre 2026 (217 Md$ sur 510 Md$ selon Crunchbase) est allé à OpenAI et Anthropic seuls. La concentration est spectaculaire.
Open source : GLM-5.2 et Kimi K2.7 Code gardent la cadence
Le tempo des labos chinois ne faiblit pas. Mi-juin, deux modèles open source majeurs sont sortis presque simultanément : GLM-5.2 de Z.ai (MIT, contexte 1M, 91,2% sur GPQA Diamond) et Kimi K2.7 Code de Moonshot AI (Modified MIT, +21,8% sur les benchmarks agentic coding par rapport à K2.6). MiniMax M3 avait ouvert le mois de juin avec 59,0% sur SWE-Bench Pro, en revendiquant être le premier modèle open-weight combinant coding frontier, contexte 1M et multimodalité native.
La conséquence pratique, pour une équipe qui déploie : la question « faut-il utiliser du propriétaire ou de l’open source ?» se pose différemment sur chaque axe. Sur du long-context factuel, un GLM-5.2 tient la comparaison avec les tiers mid des propriétaires. Sur du coding agentic autonome, GPT-5.5 et Opus 4.8 gardent une avance nette. La bonne stratégie est de router par workload plutôt que de standardiser sur un modèle.
Le vrai calendrier de la semaine : l’EU AI Act le 2 août
Sous le bruit des modèles, le calendrier réglementaire européen avance. Le 2 août 2026, l’article 50 de l’EU AI Act entre en application. Concrètement : tout système IA en interaction avec un humain doit déclarer être une IA, sauf cas d’évidence manifeste. La Commission gagne ses pouvoirs de sanction sur les GPAI providers, et les autorités nationales de surveillance peuvent enquêter et sanctionner. Le Digital Omnibus adopté début mai a repoussé certaines obligations high-risk, mais pas la transparence.
Pour les équipes produit : Warning il reste trois semaines pour patcher les chatbots grand public qui n’annoncent pas leur nature d’IA. Pour les éditeurs d’API, le sujet est le model card et le red-teaming report. Le coût d’une non-conformité sur GPAI peut monter jusqu’à 3% du chiffre d’affaires mondial ou 15 M€.
Testez votre lecture de la semaine
Combien coûte GPT-5.6 Sol en output par million de tokens ?
Quel est le contexte maximum de Muse Spark 1.1 ?
Quel montant SpaceX paie-t-il pour acquérir Anysphere (Cursor) ?
Quelle date active l’article 50 de l’EU AI Act et les pouvoirs de sanction sur les GPAI ?
Quel modèle open source atteint 91,2% sur GPQA Diamond en juin 2026 ?