Sonnet 5, LongCat 1,6 T, GPT-5.6 gated : la carte des LLMs a bougé cette semaine

— Agentia Academy

Sonnet 5, LongCat 1,6 T, GPT-5.6 gated : la carte des LLMs a bougé cette semaine

En sept jours, Anthropic a basculé Claude Sonnet 5 en modèle par défaut, Meituan a libéré un modèle 1,6 trillion de paramètres entraîné sans une seule puce Nvidia, et OpenAI a placé GPT-5.6 derrière un mur gouvernemental américain. Trois signaux, trois stratégies : le marché ne se lit plus avec une seule échelle.

.news-article { max-width: 760px; margin: 0 auto; line-height: 1.65; color: #1c1c1c; font-family: "Urbanist", -apple-system, BlinkMacSystemFont, "Segoe UI", "Helvetica Neue", Arial, sans-serif; -webkit-font-smoothing: antialiased; -moz-osx-font-smoothing: grayscale; } .news-article h1, .news-article h2, .news-article h3 { font-family: "Urbanist", -apple-system, BlinkMacSystemFont, "Segoe UI", "Helvetica Neue", Arial, sans-serif; font-weight: 700; color: #1a1a1a; } .news-article h1 { font-size: 2.1rem; line-height: 1.2; margin: 0 0 1.2rem; letter-spacing: -0.01em; } .news-article h2 { font-size: 1.45rem; margin: 2.4rem 0 0.8rem; letter-spacing: -0.005em; } .news-article p { margin: 0 0 1rem; } .news-article .aa-lede { font-size: 1.18rem; color: #2a2a2a; font-style: italic; margin-bottom: 1.8rem; } .news-article .aa-tldr { background: #faf6ef; border-left: 4px solid #6b4a1f; padding: 1.1rem 1.3rem; margin: 1.5rem 0 2rem; border-radius: 4px; } .news-article .aa-tldr ul { margin: 0.6rem 0 0; padding-left: 1.2rem; } .news-article .aa-tldr li { margin-bottom: 0.35rem; } /* Widget Deals */ .news-article .aa-deals-widget { margin: 2rem 0; border: 1px solid #e6dccb; border-radius: 8px; overflow: hidden; background: #fffdf8; } .news-article .aa-deals-filters { display: flex; flex-wrap: wrap; gap: 0.5rem; padding: 1rem; background: #f6efe2; border-bottom: 1px solid #e6dccb; } .news-article .aa-deals-filter { background: #fff; color: #4a3520; border: 1px solid #d4c6ad; padding: 0.45rem 0.95rem; border-radius: 999px; font-size: 0.88rem; font-weight: 500; cursor: pointer; transition: all 0.15s ease; font-family: inherit; } .news-article .aa-deals-filter:hover { background: #f3e9d3; border-color: #b69968; } .news-article .aa-deals-filter--active { background: #6b4a1f; color: #fff; border-color: #6b4a1f; } .news-article .aa-deals-widget table { width: 100%; border-collapse: collapse; font-size: 0.92rem; } .news-article .aa-deals-widget thead { background: #f6efe2; } .news-article .aa-deals-widget th { text-align: left; padding: 0.75rem 1rem; font-weight: 600; color: #4a3520; border-bottom: 1px solid #e6dccb; } .news-article .aa-deals-widget td { padding: 0.75rem 1rem; border-bottom: 1px solid #f0e8d6; vertical-align: top; } .news-article .aa-deals-widget tbody tr:last-child td { border-bottom: 0; } .news-article .aa-deals-widget tbody tr:hover { background: #faf6ef; } /* Badges */ .news-article .aa-badge { display: inline-block; padding: 0.18rem 0.55rem; border-radius: 4px; font-size: 0.78rem; font-weight: 600; line-height: 1.4; margin-right: 0.35rem; vertical-align: middle; } .news-article .aa-badge--funding { background: #fde8d2; color: #8a4b14; } .news-article .aa-badge--acquisition { background: #f4dcdc; color: #8a2a2a; } .news-article .aa-badge--partnership { background: #dde9f4; color: #1f4a7a; } .news-article .aa-badge--product { background: #e1ecd9; color: #2f5a1f; } .news-article .aa-badge--success { background: #d9eada; color: #1f5a2f; } .news-article .aa-badge--warning { background: #fbeccb; color: #7a5a14; } /* Quiz */ .news-article .aa-quiz { margin: 1.4rem 0; padding: 1.2rem 1.4rem; background: #fffdf8; border: 1px solid #e6dccb; border-left: 4px solid #b69968; border-radius: 6px; } .news-article .aa-quiz-question { font-weight: 600; margin: 0 0 0.9rem; color: #2a2a2a; } .news-article .aa-quiz-choice { display: block; width: 100%; text-align: left; background: #fff; color: #2a2a2a; border: 1px solid #d4c6ad; padding: 0.7rem 1rem; margin-bottom: 0.5rem; border-radius: 6px; font-size: 0.95rem; cursor: pointer; transition: all 0.15s ease; font-family: inherit; } .news-article .aa-quiz-choice:hover { background: #f6efe2; border-color: #b69968; } .news-article .aa-quiz-feedback { margin-top: 0.6rem; font-size: 0.9rem; color: #6b4a1f; font-style: italic; min-height: 1px; } /* Callouts */ .news-article [class^="aa-callout-"] { padding: 1rem 1.2rem; margin: 1.5rem 0; border-radius: 6px; border-left: 4px solid; } .news-article .aa-callout-info { background: #eaf2fb; border-color: #2a6bbf; color: #1c3a66; } .news-article .aa-callout-tip { background: #fdf3e0; border-color: #c97a1a; color: #6b3a0a; } .news-article .aa-callout-warning { background: #fbeccb; border-color: #b88012; color: #6b4a0a; } .news-article .aa-callout-success { background: #e1f0e3; border-color: #2f7a3a; color: #1c4a25; } /* Embed placeholder */ .news-article .aa-embed { margin: 1.5rem 0; padding: 1rem; background: #f6efe2; border: 1px dashed #b69968; border-radius: 6px; text-align: center; font-size: 0.85rem; color: #6b4a1f; } .news-article .aa-embed::before { content: "Embed video"; font-weight: 600; }

Sonnet 5, LongCat 1,6 T, GPT-5.6 gated : la carte des LLMs a bougé cette semaine

En sept jours, Anthropic a basculé Claude Sonnet 5 en modèle par défaut, Meituan a libéré un modèle 1,6 trillion de paramètres entraîné sans une seule puce Nvidia, et OpenAI a placé GPT-5.6 derrière un mur gouvernemental américain. Trois signaux, trois stratégies : le marché ne se lit plus avec une seule échelle.

Le résumé en 30 secondes
  • Claude Sonnet 5 remplace Sonnet 4.6 comme modèle par défaut d’Anthropic depuis le 30 juin 2026.
  • Meituan a open-sourcé LongCat-2.0, 1,6 T de paramètres, entraîné 100 % sur puces chinoises (Huawei Ascend + SMIC).
  • OpenAI a présenté GPT-5.6 (Sol, Terra, Luna) le 26 juin, réservé à environ 20 organisations gouvernementales américaines.
  • Semaine record côté capital : Joulent 1,75 Md$, Together AI 800 M$, Baseten 1,5 Md$.
  • Windsurf est devenu Devin Desktop ; Cursor pousse ses agents cloud parallèles ; Claude Fable 5 est revenu après trois semaines d’embargo export.
DateActeurOpérationMontant / Détail
le 30 juin 2026AnthropicProduitSonnet 5 par défautRemplace Sonnet 4.6 sur Claude.ai et l’API
le 29 juin 2026MeituanProduitLongCat-2.0 open source1,6 T paramètres, Apache 2.0, chips chinois
le 26 juin 2026OpenAIProduitGPT-5.6 previewSol / Terra / Luna, gated US-gov (~20 orgs)
le 28 juin 2026xAIProduitGrok 4.5 bêtaAccès fermé, pas de date publique
début juillet 2026JoulentLevéeStratégique1,75 Md$ (infra AI-energy)
début juillet 2026Together AILevéeSeries C800 M$, valo post-money 8,3 Md$, Aramco lead
juin 2026BasetenLevéeSeries F1,5 Md$ (inference systems software)
juin 2026Upscale AILevéeSeries A extended190 M$ (total 500 M$, valo 2 Md$)
le 2 juin 2026Cognition / WindsurfAcquisitionRebrandWindsurf devient Devin Desktop
février 2026Meta — NvidiaPartenariatContrat élargiMillions de puces Vera Rubin + CPU standalone

Sonnet 5 : Anthropic ferme l’écart avec Opus sans monter le prix

Le 30 juin 2026, Anthropic a basculé Claude Sonnet 5 en modèle par défaut sur Claude.ai et l’API, en remplacement de Sonnet 4.6. La lecture court terme est simple : le mid-tier reprend la couronne de l’écriture longue et grignote la majeure partie de l’écart avec Opus 4.8 sur les benchmarks de raisonnement multi-étapes, sans mouvement de prix. Autrement dit, pour une part importante des cas d’usage produit, la question « Sonnet ou Opus ? » redevient tranchable au coeur d’un pipeline, plutôt que par défaut vers le modèle premium.

La lecture stratégique est plus intéressante. Anthropic est resté silencieux côté produit pendant près de trois mois pendant que Google poussait Gemini 3.5 Flash et que le marché s’ouvrait à DeepSeek V4 et Kimi K2.6. Sortir Sonnet 5 au 30 juin ferme la fenêtre béante et reprend l’initiative sur le segment où se joue réellement le volume d’usage professionnel. Bonus : Claude Fable 5, le modèle image et vidéo, est de nouveau accessible mondialement depuis le 1er juillet, après la levée de l’ordre d’export du 12 juin qui l’avait retiré pendant près de trois semaines. La véritable question, pour un DSI ou un product owner, est : comment reconfigurer un routeur de modèles qui envoyait 40 % du trafic vers Opus 4.8 à l’aveugle ?

LongCat-2.0 : la Chine aligne un modèle 1,6 T sans une seule puce Nvidia

Le 29 juin, Meituan a libéré LongCat-2.0, un modèle spécialisé code, 1,6 trillion de paramètres, sous licence Apache 2.0, entraîné intégralement sur puces domestiques — Huawei Ascend pour le calcul, fondeur SMIC pour la gravure. C’est la première démonstration crédible qu’un flagship de la taille des modèles frontier américains peut sortir d’un pipeline 100 % chinois. Pris séparément, chaque annonce chinoise de 2026 pouvait se lire comme un rattrapage : Kimi K2.6 (58,6 % sur SWE-bench Pro), Qwen 3.7 Max (92,4 GPQA Diamond), GLM-5.2 approchant Opus 4.8 à coût divisé par 4 à 10, DeepSeek V4 Pro (80,6 % SWE-bench Verified). Pris ensemble, c’est une stratégie industrielle qui aligne un écosystème complet.

Pour l’occidental qui construit un stack agentique, deux conséquences immédiates. Premièrement, la question « peut-on faire tourner un modèle de qualité frontier en local et sur des chips non-américains ? » a maintenant une réponse publique. Deuxièmement, les grilles tarifaires des labos US perdent une partie de leur pouvoir d’ancrage : quand Kimi K2.6 ou Qwen 3.7 tournent chez un fournisseur européen ou en on-premise pour 15 à 25 % du prix d’Opus, l’arbitrage de routage devient un vrai levier de marge, pas un exercice théorique. Ce mouvement a un côté géopolitique évident, mais le réflexe utile pour un équipe produit reste opérationnel : benchmarker soi-même, ne pas croire les slides.

GPT-5.6 gated : OpenAI teste la distribution « compliance-first »

Le 26 juin, OpenAI a présenté la famille GPT-5.6 — Sol, Terra, Luna — mais l’a placée derrière une liste d’accès d’environ 20 organisations gouvernementales et de sécurité américaines. La preview publique est promise « dans les semaines à venir », sans date engage. Le signal produit est secondaire, le signal de distribution est le vrai sujet : OpenAI teste un canal de commercialisation compliance-first, où le modèle frontier arrive d’abord dans l’infrastructure régulée (Défense, DOE, DHS, agences fiscales) avant l’API grand public.

Ce virage doit se lire en parallèle de la discussion récurrente sur une prise de participation potentielle de l’État américain au capital d’OpenAI, après les 110 Md$ levés à 730 Md$ de valorisation. Le modèle économique se dessine : accès prioritaire à l’infra fedérale, contrats long terme sur mesure, et un marché API B2B qui devient un canal secondaire. Pour un concurrent européen, la lecture est claire : la commande publique américaine devient un rempart concurrentiel dur, et le canal export ne suffira pas à construire un équivalent Mistral ou une reprise d’Aleph Alpha sans une commande équivalente en Europe. Pour un client final, il faut intégrer que le modèle auquel on a accès aujourd’hui n’est plus nécessairement le state-of-the-art : la version la plus avancée vit dans un périmètre sécurisé, hors marché ouvert.

Cursor, Devin Desktop, Claude Code : la bataille se joue sur les agents cloud

La grande recomposition de l’outillage dev IA n’est plus une histoire d’éditeur ou de complétion in-line. Cursor a livré en juin sa vue « Agents » : plusieurs agents tournent en parallèle, chacun sur une copie isolée du repo, avec un Dockerfile, ses secrets et un workspace multi-repo. Windsurf a été rebadgé Devin Desktop le 2 juin, avec un pricing complet Free / Pro 20 € / Max 200 € / Teams 80 € + 40 € par siège, aligné sur la réalité d’un agent qui consomme du temps machine sérieux. Claude Code garde une avance sur l’exécution en shell autonome et l’orchestration multi-modèle, avec Sonnet 5 en défaut et Opus 4.8 disponible pour les workflows dynamiques.

Le fond du sujet, si on débran-che de la question du logo, c’est l’infrastructure d’agents. Un dev senior en juillet 2026 ne compare plus des IDE : il compare des runners parallèles, des politiques de secrets, des écosystèmes MCP installés, et un coût horaire d’agent. GitHub Copilot a répondu avec un billing flex et un plan Max à 100 $/mois. Anthropic pousse Claude Code par le défaut Sonnet 5 et l’ouverture progressive des Dynamic Workflows. La question à se poser, pour une équipe entre 5 et 50 dev, est moins « quel outil ? » que « combien d’agents en parallèle peut-on solvabiliser sur un release train ? » ; c’est là que le prix par task se joue vraiment.

Runtimes locaux et MCP : le stack offline devient sérieux

Autre mouvement discret mais structurant : LM Studio et Ollama ont ajouté le support MCP côté client au cours du printemps 2026, et vLLM, llama.cpp et MLX ont à peu près tous aligné leurs intégrations. Conséquence pratique : on peut aujourd’hui brancher Claude Code (ou un IDE agentique) sur un modèle Qwen 3.7 ou Kimi K2.6 qui tourne localement, et l’ensemble consomme les mêmes serveurs MCP que le stack cloud. La démonstration était faisable en avril, elle devient viable en juillet.

L’implication dépasse le confort. Une PME européenne qui traite de la donnée réglementée peut monter un pipeline agent 100 % offline pour environ 6 000 € de matériel — Mac Studio 128 Go dédié MLX, ou station AMD Ryzen AI Max sous LM Studio et ROCm — et rester sur les mêmes conventions d’outillage que ses concurrents cloud. Combiné à l’arrivée de modèles open source qui approchent Opus 4.8 sur les benchmarks agentiques, l’arbitrage « on garde tout dedans, on n’envoie rien au cloud » a maintenant un vrai visage, y compris pour du travail créatif ou du code review avancé. Ce n’est pas le futur ambient, c’est une option de rentrée 2026.

Argent chaud : Joulent, Together AI, Baseten et l’inflation infra

La semaine côté capital confirme que le flux se concentre sur l’infrastructure d’inférence et l’énergie. Joulent a levé 1,75 Md$ en stratégique, Together AI 800 M$ en Series C valorisée 8,3 Md$ post-money avec Aramco Ventures en lead, Baseten 1,5 Md$ en Series F sur son système d’exécution d’inférence, et Upscale AI 190 M$ en extension de Series A pour finir à 500 M$ levés et 2 Md$ de valorisation. En parallèle, Meta continue d’ingérer Nvidia par millions de puces (Vera Rubin + CPU standalone), et prépare une offre de location externe de son exccès de GPU aux entreprises tierces.

Côté consommation, Google a annoncé une hausse de 37 % de la consommation électrique de ses datacenters sur douze mois — un record de la décennie. La lecture est double. D’abord, l’échelle : les ventes d’AMD sur datacenter ont atteint 5,8 Md$ au Q1 2026 (+57 % YoY), et le guidance Q2 vise 11,2 Md$ (+46 % YoY), pour une part de marché qui reste minoritaire face aux 81 % de Nvidia selon IDC. Ensuite, le coût réel : le taux d’inflation du kWh spécifique aux datacenters devient le facteur caché du prix d’un token, et le lieu d’installation compte plus que le fournisseur de modèle. C’est aussi ce que capte Joulent en levant sur le mix compute-énergie plutôt que sur un simple play modèle.

Testez votre lecture de la semaine

Quel modèle est devenu le défaut d’Anthropic le 30 juin 2026 ?

Combien de paramètres compte LongCat-2.0, le modèle open source libéré par Meituan ?

Quel est le point commun entre les trois modèles OpenAI GPT-5.6 Sol, Terra et Luna ?

Quel outil dev IA a été rebadgé Devin Desktop le 2 juin 2026 ?

Quelle plus grosse levée AI a été annoncée cette semaine ?

À retenir pour la semaine prochaine : ce n’est plus le modèle qui décide de votre pile, c’est le routeur. Sonnet 5, Kimi K2.6, Qwen 3.7 et GPT-5.5 vont co-exister dans le même pipeline ; celui qui saura arbitrer par coût-latence-qualité au niveau du call gagnera la marge. Auditez dès lundi votre part de trafic envoyée vers Opus 4.8 « par défaut » — c’est probablement 30 à 40 % de tokens facturables à réaffecter.

← Toutes les actualités IA · Nos formations IA