GPT-5.5 reprend la tête, Fable 5 perd l'accès libre : la semaine où l'IA a rebattu ses cartes

— Agentia Academy

GPT-5.5 reprend la tête, Fable 5 perd l'accès libre : la semaine où l'IA a rebattu ses cartes

Cinq jours pour voir bouger trois plaques tectoniques : un benchmark agentique repris par OpenAI, un modèle Anthropic coupé sur ordre du gouvernement américain, et l'open source qui rejoint les frontier labs à moins d'un point de marge.

.news-article { max-width: 760px; margin: 0 auto; line-height: 1.65; color: #1c1c1c; font-family: "Urbanist", -apple-system, BlinkMacSystemFont, "Segoe UI", "Helvetica Neue", Arial, sans-serif; -webkit-font-smoothing: antialiased; -moz-osx-font-smoothing: grayscale; } .news-article h1, .news-article h2, .news-article h3 { font-family: "Urbanist", -apple-system, BlinkMacSystemFont, "Segoe UI", "Helvetica Neue", Arial, sans-serif; font-weight: 700; color: #1a1a1a; } .news-article h1 { font-size: 2.1rem; line-height: 1.2; margin: 0 0 1.2rem; letter-spacing: -0.01em; } .news-article h2 { font-size: 1.45rem; margin: 2.4rem 0 0.8rem; letter-spacing: -0.005em; } .news-article p { margin: 0 0 1rem; } .news-article .aa-lede { font-size: 1.18rem; color: #2a2a2a; font-style: italic; margin-bottom: 1.8rem; } .news-article .aa-tldr { background: #faf6ef; border-left: 4px solid #6b4a1f; padding: 1.1rem 1.3rem; margin: 1.5rem 0 2rem; border-radius: 4px; } .news-article .aa-tldr ul { margin: 0.6rem 0 0; padding-left: 1.2rem; } .news-article .aa-tldr li { margin-bottom: 0.35rem; } /* Widget Deals */ .news-article .aa-deals-widget { margin: 2rem 0; border: 1px solid #e6dccb; border-radius: 8px; overflow: hidden; background: #fffdf8; } .news-article .aa-deals-filters { display: flex; flex-wrap: wrap; gap: 0.5rem; padding: 1rem; background: #f6efe2; border-bottom: 1px solid #e6dccb; } .news-article .aa-deals-filter { background: #fff; color: #4a3520; border: 1px solid #d4c6ad; padding: 0.45rem 0.95rem; border-radius: 999px; font-size: 0.88rem; font-weight: 500; cursor: pointer; transition: all 0.15s ease; font-family: inherit; } .news-article .aa-deals-filter:hover { background: #f3e9d3; border-color: #b69968; } .news-article .aa-deals-filter--active { background: #6b4a1f; color: #fff; border-color: #6b4a1f; } .news-article .aa-deals-widget table { width: 100%; border-collapse: collapse; font-size: 0.92rem; } .news-article .aa-deals-widget thead { background: #f6efe2; } .news-article .aa-deals-widget th { text-align: left; padding: 0.75rem 1rem; font-weight: 600; color: #4a3520; border-bottom: 1px solid #e6dccb; } .news-article .aa-deals-widget td { padding: 0.75rem 1rem; border-bottom: 1px solid #f0e8d6; vertical-align: top; } .news-article .aa-deals-widget tbody tr:last-child td { border-bottom: 0; } .news-article .aa-deals-widget tbody tr:hover { background: #faf6ef; } /* Badges */ .news-article .aa-badge { display: inline-block; padding: 0.18rem 0.55rem; border-radius: 4px; font-size: 0.78rem; font-weight: 600; line-height: 1.4; margin-right: 0.35rem; vertical-align: middle; } .news-article .aa-badge--funding { background: #fde8d2; color: #8a4b14; } .news-article .aa-badge--acquisition { background: #f4dcdc; color: #8a2a2a; } .news-article .aa-badge--partnership { background: #dde9f4; color: #1f4a7a; } .news-article .aa-badge--product { background: #e1ecd9; color: #2f5a1f; } .news-article .aa-badge--success { background: #d9eada; color: #1f5a2f; } .news-article .aa-badge--warning { background: #fbeccb; color: #7a5a14; } /* Quiz */ .news-article .aa-quiz { margin: 1.4rem 0; padding: 1.2rem 1.4rem; background: #fffdf8; border: 1px solid #e6dccb; border-left: 4px solid #b69968; border-radius: 6px; } .news-article .aa-quiz-question { font-weight: 600; margin: 0 0 0.9rem; color: #2a2a2a; } .news-article .aa-quiz-choice { display: block; width: 100%; text-align: left; background: #fff; color: #2a2a2a; border: 1px solid #d4c6ad; padding: 0.7rem 1rem; margin-bottom: 0.5rem; border-radius: 6px; font-size: 0.95rem; cursor: pointer; transition: all 0.15s ease; font-family: inherit; } .news-article .aa-quiz-choice:hover { background: #f6efe2; border-color: #b69968; } .news-article .aa-quiz-feedback { margin-top: 0.6rem; font-size: 0.9rem; color: #6b4a1f; font-style: italic; min-height: 1px; } /* Callouts */ .news-article [class^="aa-callout-"] { padding: 1rem 1.2rem; margin: 1.5rem 0; border-radius: 6px; border-left: 4px solid; } .news-article .aa-callout-info { background: #eaf2fb; border-color: #2a6bbf; color: #1c3a66; } .news-article .aa-callout-tip { background: #fdf3e0; border-color: #c97a1a; color: #6b3a0a; } .news-article .aa-callout-warning { background: #fbeccb; border-color: #b88012; color: #6b4a0a; } .news-article .aa-callout-success { background: #e1f0e3; border-color: #2f7a3a; color: #1c4a25; } /* Embed placeholder */ .news-article .aa-embed { margin: 1.5rem 0; padding: 1rem; background: #f6efe2; border: 1px dashed #b69968; border-radius: 6px; text-align: center; font-size: 0.85rem; color: #6b4a1f; } .news-article .aa-embed::before { content: "Embed video"; font-weight: 600; }

GPT-5.5 reprend la tête, Fable 5 perd l'accès libre : la semaine où l'IA a rebattu ses cartes

Cinq jours pour voir bouger trois plaques tectoniques : un benchmark agentique repris par OpenAI, un modèle Anthropic coupé sur ordre du gouvernement américain, et l'open source qui rejoint les frontier labs à moins d'un point de marge.

Le résumé en 30 secondes
  • GPT-5.5 passe devant Claude Fable 5 sur Agents’ Last Exam (24,0% contre 22,0%).
  • Le 12 juin, le BIS américain a ordonné à Anthropic de couper Fable 5 et Mythos 5 ; le free trial Claude se termine aujourd’hui, le 22 juin 2026.
  • OpenAI rachète Astral (uv, ruff) pour ancrer Codex dans l’écosystème Python.
  • DeepSeek V4-Pro atteint 80,6% sur SWE-bench Verified, à 0,2 point d’Opus 4.6, sous licence MIT.
  • Coalition IA US-led portée par Anthropic et DeepMind au G7 ; l’AI Act européen s’applique le 2 août (J-41).
DateActeurOpérationMontant / Détail
18 juin 2026Robo.ai / QC CapitalAcquisition Rachat 100% des parts60 M$ en actions Class B
17 juin 2026Anthropic + Google DeepMindPartenariat Coalition IA US-led au G7Réunion fermée, ~12 patrons tech
juin 2026OpenAI / AstralAcquisition uv + ruff pour CodexMontant non divulgué
juin 2026Boston Dynamics + Google CloudPartenariat Gemini Robotics-ER 1.6 sur Spot & Orbit AIInspection industrielle
juin 2026Z.aiProduit GLM-5.2 open weightsGains coding + agentique
juin 2026Moonshot (Kimi)Produit Kimi K2.7 Code HighSpeed6× vitesse d’inférence multimodale
juin 2026MistralProduit Medium 3.5 open weights128B dense, licence MIT modifiée
juin 2026NVIDIAProduit Nemotron 3 UltraRatio capacité:efficacité notable
Q1 2026AnthropicLevée Series H65 Md$ — valorisation 965 Md$
Q1 2026xAILevée Round stratégique20 Md$

Le benchmark qui a fait bouger les lignes

Première fois depuis Opus 4.6 en avril : OpenAI repasse devant Anthropic sur une métrique pondérée par les agents codeurs longs. Sur le nouveau Agents’ Last Exam (ALE), publié cette semaine, GPT-5.5 affiche 24,0% de pass rate contre 22,0% pour Claude Fable 5. L’écart est de deux points, donc faible — mais sur ALE, ces deux points représentent environ 47 tâches résolues en plus sur un total de 2 350 scénarios multi-tours.

Le détail compte. ALE intègre des tâches où l’agent doit interagir avec un système de fichiers, des APIs externes et une base de code de plus de 80 000 lignes. C’est moins un test de modèle qu’un test de boucle agent + harness + outils. Quand GPT-5.5 gagne deux points ici, il gagne autant par les améliorations du noyau que par la maturité du runtime Codex. Anthropic n’est pas largué : Opus 4.7 reste devant sur les benchmarks de raisonnement pur. Mais le terrain qui intéresse les équipes produit, l’exécution autonome, vient de basculer.

Le signal à retenir : la course agentique se joue désormais à deux points, plus à vingt. Quand le spread se réduit, les choix d’adoption se font sur la fiabilité opérationnelle, le coût d’inférence et la disponibilité régionale, plus sur le score top-line.

Anthropic, le BIS et un précédent qui change la donne

Le 12 juin 2026, le Bureau of Industry and Security (BIS), l’autorité export-control du département du Commerce américain, a notifié à Anthropic l’obligation de couper l’accès à Fable 5 et Mythos 5 pour les usages listés. C’est, à notre connaissance, le premier cas documenté où une directive export-control vise un modèle IA commercial déployé en API plutôt qu’un produit physique.

Conséquence immédiate : Anthropic a désactivé les endpoints concernés le jour même. Conséquence calendaire : le free trial Fable 5, ouvert le 9 juin aux abonnés Claude Pro, Max, Team et Enterprise, ferme aujourd’hui 22 juin. À partir de demain, l’accès nécessite des crédits d’usage payés, au tarif de 10 $ / 50 $ par million de tokens input/output.

L’onde de choc dépasse Anthropic. Un parlementaire européen, cité cette semaine, résume : « l’Europe ne peut pas construire sa tech stack sur un accès qui peut être coupé du jour au lendemain par un gouvernement étranger ». Le même argument vaudra pour OpenAI, Google DeepMind, xAI : si le BIS a fait jurisprudence sur Fable 5, l’outil est réutilisable sur n’importe quelle API frontier. Pour les DSI européens, le calcul de risque sur le modèle bouge cette semaine, même s’ils n’ont rien acheté chez Anthropic.

Astral chez OpenAI : Codex prend racine en Python

OpenAI annonce l’acquisition d’Astral, la startup derrière uv (gestionnaire de paquets Python) et ruff (linter et formateur). Montant non divulgué. uv a pris en moins de 18 mois la place de pip sur les CI modernes : en interne chez plusieurs grands acteurs, il résout un graphe de dépendances jusqu’à 100 fois plus vite. ruff, lui, lint un fichier en quelques millisecondes là où flake8 prenait plusieurs centaines.

L’intégration cible Codex. La logique est claire : un agent de code passe l’essentiel de son temps non pas à rédiger, mais à exécuter, vérifier, corriger. Plus vite ses primitives (install, lint, format, test) tournent, plus son cycle se raccourcit. En internalisant uv et ruff, OpenAI réduit la dépendance de Codex à l’environnement utilisateur et homogénéise la boucle d’exécution sur ses propres infras d’inférence.

Le mouvement est aussi défensif. GitHub Copilot, qui bénéficie de l’intégration native à VS Code et au worktree Git, a annoncé le 1er juin son flex billing : 10 $ par mois pour 1 500 crédits, 100 $ pour 20 000 crédits via le plan Max. Sur ce terrain, OpenAI a besoin de tooling propre pour ne pas se faire dépasser sur la fluidité. Astral est ce tooling.

Open source : la marge avec les frontier labs tient en 0,2 point

Le chiffre du week-end : DeepSeek V4-Pro atteint 80,6% sur SWE-bench Verified, à 0,2 point d’Opus 4.6 (80,8%), sous licence MIT. C’est en deçà de la marge d’erreur des benchs sur ce volume, donc statistiquement à égalité. Une équipe qui n’a pas besoin du dernier point de pass rate peut servir DeepSeek V4-Pro sur sa propre infra et économiser les 10 $ / 50 $ par million de tokens facturés par les API fermées.

Cette semaine apporte trois autres releases lourdes : GLM-5.2 chez Z.ai, avec des gains nets sur les tâches agentiques ; Kimi K2.7 Code HighSpeed chez Moonshot, qui revendique 6× la vitesse d’inférence multimodale de K2.6 sur du code ; Nemotron 3 Ultra chez NVIDIA, avec un ratio capacité:efficacité mentionné par plusieurs benchmarks comme l’un des plus équilibrés du moment. Mistral Medium 3.5, sorti en open weights sous une licence MIT modifiée, tient ses 128 milliards de paramètres denses sur quatre GPUs en self-host.

Le scénario d’il y a 12 mois — les frontier labs détiennent un modèle 30 points au-dessus — n’existe plus. Le nouvel arbitrage : 0,2 point de pass rate vaut-il l’exposition réglementaire, le coût et la dépendance à une API tierce ? Pour beaucoup d’équipes en Europe, la réponse vient de changer.

G7, coalition et J-41 avant l’AI Act

Le 17 juin, en marge du G7, Dario Amodei (Anthropic) et Demis Hassabis (Google DeepMind) ont co-piloté une réunion à huis clos avec une douzaine de patrons tech, dont Sam Altman, et plusieurs chefs d’État. Objectif annoncé : poser les bases d’une coalition démocratique de l’IA coordonnée par Washington. Aucun communiqué commun n’a été publié, mais les sources concordantes pointent vers un alignement sur les standards d’évaluation, les contrôles d’exportation et les flux de calcul.

En face, l’Union européenne maintient son calendrier : les obligations principales de l’AI Act s’appliquent le 2 août 2026, soit dans 41 jours. Les systèmes classés haut risque (emploi, éducation, infrastructures critiques, services financiers, services essentiels, application de la loi, migration, justice) doivent être conformes à cette date. Pour les acheteurs B2B, l’audit interne ne peut plus attendre : prouver la classification du risque, documenter les jeux de données, formaliser la surveillance humaine.

Le contraste de timing est frappant. Washington pousse une coalition souple co-portée par les laboratoires. Bruxelles applique un cadre prescriptif qui couvre les mêmes modèles. Les acteurs intelligents ne choisissent pas leur camp : ils préparent les deux livraisons.

Outils dev : flex billing, Devin Desktop, et un stack qui se réagence

Trois semaines de mouvements coordonnés sur les outils dev. GitHub Copilot a activé son flex billing le 1er juin : Pro à 10 $/mois pour 1 500 crédits (valeur 15 $), Pro+ à 39 $/mois pour 7 000 crédits, et le nouveau Max à 100 $/mois pour 20 000 crédits. Le 2 juin, Windsurf est devenu Devin Desktop sous la marque Cognition. Cursor a revu sa grille Teams. Et côté Mountain View, Antigravity 2.0 a embarqué Gemini 3.5 Flash comme modèle par défaut.

Mistral n’est pas en reste. Le chatbot Le Chat est devenu Vibe en mai, avec un Work Mode pour les tâches longues, un Code Mode pour le coding agentique distant, une extension VS Code et un CLI étendu. Le modèle par défaut est Medium 3.5, le même que les utilisateurs peuvent exécuter en self-host pour moins de 5 000 $ d’infra.

Ce qu’il faut lire dans tout ça : le coding agent n’est plus une fonctionnalité ajoutée à un IDE, c’est devenu la surface principale du produit. Le terminal, l’éditeur, le navigateur convergent vers une même boucle d’exécution pilotée par un agent. Pour les équipes qui n’ont pas encore arrêté leur outil de référence, juin est un mois chaôtique à observer mais probablement un mauvais moment pour signer un contrat annuel.

Testez votre lecture de la semaine

Sur quel benchmark GPT-5.5 vient-il de passer devant Claude Fable 5 ?

Quelle autorité américaine a ordonné la suspension des modèles Fable 5 et Mythos 5 le 12 juin ?

Quelles bibliothèques Python OpenAI a-t-il acquises en rachetant Astral ?

Quel score DeepSeek V4-Pro a-t-il atteint sur SWE-bench Verified cette semaine ?

À quelle date l’AI Act européen s’applique-t-il pleinement aux systèmes haut risque ?

À retenir pour la semaine prochaine : regardez le benchmark Agents’ Last Exam comme un terrain glissant, pas un classement stable. Si GPT-5.5 a pris 2 points cette semaine, la riposte d’Anthropic ou de DeepMind est probable d’ici 30 jours. Et vérifiez si votre stack interne tient si un fournisseur frontier devient indisponible 48 heures : c’est le vrai test que la directive BIS du 12 juin vient de poser à tout le marché.

← Toutes les actualités IA · Nos formations IA