Grok 4.5, GPT-5.6, Gemini 3.5 Pro : dix jours qui rebattent la carte de l'IA frontier
xAI a livré Grok 4.5 le 8 juillet, GPT-5.6 est attendu cette semaine, Gemini 3.5 Pro est repoussé au 17 juillet. Trois releases frontier en dix jours, sur fond de rachat de Cursor par SpaceX et de recul européen sur l'AI Act. Le cycle produit IA n'a plus de saison creuse.
- Grok 4.5 est sorti le 8 juillet 2026 avec 21 nouvelles voix multilingues et un Voice Agent Builder no-code en beta.
- Claude Sonnet 5 est devenu le modèle par défaut sur Free et Pro depuis le 1er juillet, à 2$/10$ par million de tokens jusqu'au 31 août.
- SpaceX a confirmé le rachat d'Anysphere (Cursor) pour 60 Md$, closing prévu au Q3 2026.
- Le Conseil de l'UE a repoussé au 2 décembre 2027 l'entrée en vigueur des obligations IA haut risque stand-alone.
- Le H1 2026 a battu tous les records : 510 Md$ investis en capital-risque, dont 217 Md$ concentrés sur OpenAI et Anthropic.
Grok 4.5 : xAI ouvre le front voix + agents opérationnels
xAI a publié Grok 4.5 le 8 juillet 2026, mais l'événement n'est pas là où on l'attendait. Plutôt que de courir après GPT-5.6 ou Opus 4.8 sur le raisonnement pur, xAI a livré 21 nouvelles voix multilingues sur son API Voice, un Voice Agent Builder no-code en beta et une couche complète intégrant téléphonie, récupération de connaissances, MCP, guardrails, observabilité, cloning vocal et SIP dans un seul produit. C'est un pari de segmentation : aller chercher les cas d'usage vocaux enterprise que ni Anthropic ni OpenAI ne packagent verticalement.
Sur le noyau LLM, Grok 4.5 apporte des améliorations sur la gestion de contextes longs et la fidélité instruction-suivi, mais le vrai signal produit est ailleurs. En livrant un « Voice Agent Builder » utilisable sans code par un centre d'appel ou un SaaS, xAI cible directement le marché des intégrateurs qui aujourd'hui assemblent LangChain, Twilio, Whisper, un TTS tiers et un LLM à la main. La question ouverte reste la latence réelle en production sur les langues autres que l'anglais, xAI n'ayant pas encore publié de benchmark indépendant.
Anthropic : Sonnet 5 devient le modèle par défaut, Fable 5 revient
Le 1er juillet 2026, Anthropic a fait basculer tous les utilisateurs Free et Pro sur Claude Sonnet 5 comme modèle par défaut, dans le monde entier. Le modèle est proposé à un tarif d'appel de 2$ par million de tokens en entrée et 10$ en sortie jusqu'au 31 août 2026, puis 3$/15$ ensuite. C'est officiellement moins cher que Sonnet 4.6, pour des performances qualifiées de proches d'Opus 4.8 sur les tâches agentiques les plus courantes.
Le même jour, Fable 5 est redéployé globalement après une suspension de 18 jours déclenchée le 12 juin par une directive de contrôle export américaine. La cause : des chercheurs d'Amazon avaient documenté un moyen de contourner les garde-fous de Fable 5. Anthropic a livré un classifieur automatique correctif, ce qui a permis la levée de la restriction. La lecture stratégique : pour la première fois, un contrôle export s'applique à une release IA en réaction à une vulnérabilité publique, pas à une exportation de puces. Cela crée un précédent que d'autres frontier labs vont devoir intégrer à leur roadmap.
OpenAI, GPT-5.6 et l'offre à 5% au gouvernement fédéral
GPT-5.6 est attendu entre le 7 et le 9 juillet 2026, avec des gains annoncés sur la vitesse et la fiabilité. La famille alimente déjà Codex en trois variantes internes appelées Sol, Terra et Luna, chacune optimisée pour un profil de charge (batch offline, interactif, temps réel). C'est la première fois qu'OpenAI expose publiquement une segmentation aussi granulaire de la même famille de modèles : le signal envoyé aux acheteurs enterprise est que le prix / performance devient un slider, pas une gamme figée.
En parallèle, OpenAI a proposé au gouvernement fédéral américain de prendre 5% de son capital, soit environ 42,6 Md$ sur une valorisation de 852 Md$ selon le Financial Times. Le raisonnement affiché par Sam Altman est celui d'un « nouvel ordre mondial » sur l'IA, alors qu'OpenAI perd du terrain relatif face à Google et Anthropic sur les benchmarks. La lecture sèche : le capital d'État devient un actif de négociation réglementaire, comme il l'a été pour le nucléaire civil et pour Airbus.
Google : Gemini 3.5 Pro repoussé au 17 juillet
Google DeepMind a repoussé la sortie de Gemini 3.5 Pro au 17 juillet 2026, en abandonnant l'architecture existante Gemini 2.5 Pro pour une refonte complète. La nouvelle mouture cible le raisonnement mathématique, la génération de scènes SVG et la qualité image pour rivaliser avec GPT-5.6 et Fable 5. Elle apporte une fenêtre de contexte de 2 millions de tokens, une couche « Deep Think Reasoning » et des capacités de workflow autonomes en intégration native.
La décision de tout refondre plutôt que d'itérer sur 2.5 est notable : elle indique que Google a jugé que le fossé avec Fable 5 et le futur GPT-5.6 ne pouvait pas être comblé par une simple mise à jour incrémentale. Le retard coûte en cadence produit à court terme, mais si le 17 juillet tient, Google reprend la main avec la fenêtre de contexte la plus longue du marché frontier propriétaire. Pour les développeurs, la question pratique reste le prix par million de tokens sur ce contexte 2M.
Cursor absorbé par SpaceX : la fin d'un IDE indépendant ?
SpaceX est entré en Bourse en juin à une valorisation de 1 770 Md$ en levant 75 Md$, et a confirmé le rachat d'Anysphere, éditeur de Cursor, pour 60 Md$ all-stock, avec un closing prévu au Q3 2026. Sur le produit, Cursor a livré sa refonte multi-agents : agents lancés en parallèle sur des copies isolées du repo via Dockerfile, workspaces multi-repos, vue dédiée Agents. Windsurf, de son côté, est devenu Devin Desktop le 2 juin, avec l'agent local Cascade en fin de vie le 1er juillet, remplacé par Devin Local qui tourne sur Claude Opus 4.8.
La bataille des IDE IA est donc passée en trois mois d'un marché indie foisonnant à une configuration à deux camps industriels : SpaceX (Cursor) et Cognition (Devin, ex-Windsurf), avec Claude Code, GitHub Copilot et Antigravity 2.0 comme options frontier. Pour un développeur indépendant, la question n'est plus « quel outil est le meilleur ? » mais « à qui appartient le pipeline de mon code en 2027 ? ».
Open source frontier : MiniMax M3 s'installe, Qwen 3.5 pousse
Le trimestre a été dense côté open weights. MiniMax M3, publié en juin 2026, est le premier modèle open-weight à combiner coding frontier, 1 million de tokens de contexte et multimodalité native. Il domine le SWE-Bench Pro open-weight à 59,0%. En avril et mai, quatre poids lourds ont également livré : DeepSeek V4 Pro (24 avril, MIT, contexte 1M, SWE-bench Verified 80,6%), Kimi K2.6 (20 avril, MIT, SWE-Bench Pro 58,6%), Qwen 3.7 Max (20 mai, GPQA Diamond 92,4 devant Claude Opus 4.6) et Mistral Large 3 (Apache 2.0, sans plafond MAU).
Au classement généraliste de juillet, Qwen 3 235B-A22B mène pour le raisonnement et le coding, DeepSeek R1 dominant sur les maths pures et Llama 4 Scout tenant le contexte long à 10 millions de tokens sur un seul H100. Le signal industriel : l'écart open-weight vs frontier propriétaire est repassé sous les 5 points de benchmark sur les tâches courantes. Pour un CTO qui construit un produit avec un budget contraint, le calcul coût / risque bascule.
Bruxelles temporise, mais durcit sur les usages abusifs
Le Conseil de l'UE a validé le 29 juin 2026 le paquet « Digital Omnibus » qui remet à plat le calendrier de l'AI Act. Les obligations pour les systèmes IA à haut risque stand-alone, qui devaient entrer en vigueur le 2 août 2026, sont repoussées au 2 décembre 2027. Pour les IA embarquées dans des produits, le curseur passe au 2 août 2028. La mise en place des bacs à sable réglementaires nationaux est repoussée au 2 août 2027.
En échange de ce report, deux durcissements : l'interdiction dès décembre 2026 des IA générant du contenu sexuel non-consenti et du CSAM, et la réduction à 3 mois (au lieu de 6) de la période de grâce pour implanter les solutions de watermarking des contenus synthétiques, avec pour date-butoir le 2 décembre 2026. La lecture : Bruxelles achète du temps à l'industrie sur la conformité structurelle, mais fixe des lignes rouges plus vite sur les usages qui ont un coût politique immédiat.
Testez votre lecture de la semaine
Quel modèle xAI est sorti le 8 juillet 2026 ?
Quel montant SpaceX propose-t-il pour racheter Anysphere (Cursor) ?
Quel est le prix d'appel de Claude Sonnet 5 par million de tokens en entrée jusqu'au 31 août ?
À quelle date les obligations IA haut risque stand-alone de l'AI Act entrent-elles en vigueur après le report ?
Quel pourcentage de son capital OpenAI a-t-il proposé au gouvernement fédéral américain ?