Le 2 août, l'IA change de régime : Bruxelles, Anthropic et Google ont réécrit la semaine
Sept jours, trois secousses simultanées : l'entrée en vigueur des obligations socles de l'EU AI Act, un quatrième modèle Claude en huit semaines, et un Gemini Robotics 2 qui pilote un humanoïde entier. Le tempo du secteur s'accélère et se centralise sur trois zones : régulation, cadence produit et brique physique.
- Le 2 août 2026, les obligations socles de l'EU AI Act s'appliquent à la majorité des systèmes IA opérant sur le marché européen — jusqu'à 35 M€ ou 7 % du CA mondial d'amende potentielle.
- Anthropic a livré Claude Opus 5 le 24 juillet 2026 — quatrième modèle en huit semaines, prix inchangés à 5 $ / 25 $ par million de tokens.
- Google DeepMind a lancé Gemini Robotics 2 le 31 juillet 2026, avec contrôle « whole-body » d'humanoïdes et coordination multi-robots.
- Alibaba pousse Qwen3.7 Flash le 27 juillet, Moonshot ouvre Kimi K3 (2,8 T paramètres) — la Chine consolide sa domination sur les poids ouverts pendant que Meta ferme Llama.
- Together AI lève 800 M$, Baseten et Fireworks AI 1,5 Md$ chacun : la bataille infra 2026 se joue sur le coût par token en inférence.
Bruxelles fixe le tempo : les obligations socles de l'EU AI Act tombent le 2 août 2026
L'événement le plus lourd de conséquences de la semaine ne porte pas de numéro de version. Le 24 juillet 2026, le règlement amendé de l'EU AI Act — dit AI Omnibus — a été publié au Journal officiel de l'Union européenne, puis est entré en vigueur le lundi 27 juillet. Le texte reporte plusieurs échéances secondaires, mais laisse intacte la date pivot : à partir du 2 août 2026, la majorité des systèmes d'IA opérant sur le marché européen tombent sous les obligations socles du règlement — transparence sur les données d'entraînement, gouvernance des risques, documentation modèle GPAI, marquage des contenus synthétiques. Concrètement, un éditeur SaaS qui embarque un LLM et le vend en Europe doit maintenant produire une fiche modèle et cartographier ses risques sur le même niveau de sérieux qu'une politique RGPD. EU AI Act La Commission européenne a doublé la mise le 7 juillet 2026 en publiant son Action Plan on Cybersecurity and AI, coordonné avec l'ENISA, qui aligne les obligations de résilience sur les modèles frontière. Angle pour un décideur français : le vrai gagnant de la semaine n'est pas un labo, c'est l'équipe compliance. La demande sur les missions freelance « AI Act readiness » a déjà commencé à monter chez les cabinets d'audit et les intégrateurs, et un fournisseur qui rate la case documentation risque des amendes calées sur le modèle RGPD, soit jusqu'à 35 M€ ou 7 % du chiffre d'affaires mondial.
Anthropic livre Claude Opus 5 le 24 juillet : quatre modèles en huit semaines
Quatre modèles en huit semaines : Sonnet 5 et Fable 5 fin juin, Mythos 5 dans la foulée, puis Claude Opus 5 livré le 24 juillet 2026. La cadence Anthropic a quitté le régime habituel des labos frontière — un modèle majeur par an — pour quelque chose qui ressemble davantage à un cycle produit SaaS classique. Opus 5 Opus 5 devient le modèle par défaut sur Claude Max et l'option la plus forte sur Claude Pro. Prix inchangés vs Opus 4.8 : 5 $ par million de tokens input, 25 $ par million de tokens output. Techniquement, la fiche fait doubler Opus 4.8 sur Frontier-Bench v0.1, s'approche à 0,5 % de Fable 5 sur CursorBench 3.2 pour moitié moins cher, et revendique un score 3× supérieur au meilleur concurrent sur ARC-AGI 3. La fenêtre de contexte tient 1 M de tokens, la sortie jusqu'à 128 K, avec cinq niveaux d'effort de raisonnement paramétrables et une bêta qui permet de changer les outils MCP en cours de conversation. Deux points à surveiller. D'abord, les gains ARC-AGI 3 méritent une réplication indépendante : c'est le seul benchmark public qui distingue vraiment un modèle qui « raisonne » d'un modèle qui interpole. Ensuite, cette cadence — un modèle tous les 15 jours en moyenne — met une pression forte sur les équipes évaluation clients, qui n'ont plus le temps de finaliser un audit avant que la version suivante ne sorte. Le régime « ship fast » vient de rattraper les labos frontière.
Google DeepMind pousse Gemini Robotics 2 le 31 juillet : l'IA quitte l'écran
Google DeepMind a publié Gemini Robotics 2 le 31 juillet 2026, dix jours après avoir sorti Gemini 3.6 Flash, Gemini 3.5 Flash-Lite et Gemini 3.5 Flash Cyber le 21 juillet. Cette nouvelle famille robotique ajoute trois briques que le précédent Gemini Robotics n'avait pas : contrôle « whole-body » (le modèle pilote un humanoïde entier, pas juste un bras), dextérité fine sur objets déformables, et coordination multi-robots sur une même tâche. La démo publique se fait avec l'humanoïde Apptronik, partenaire de Google DeepMind depuis 2024. Gemini Robotics 2 La signification stratégique dépasse la démo. Pendant qu'Anthropic et OpenAI restent purement software, Google est le seul des trois grands labos américains à parier explicitement sur la brique agent physique. Le calcul est cohérent avec la sortie de Gemini 3.6 Flash — modèle « workhorse » qui promet 17 % de tokens économisés sur les tâches de code et de multimodal — et de Gemini 3.5 Flash Cyber, fine-tuné pour la détection et le patching de vulnérabilités. Message implicite au marché : Google industrialise là où OpenAI vend du prestige et où Anthropic cadence les benchmarks. À noter aussi : Google DeepMind a repoussé Gemini 3.5 Pro et repart d'une architecture from scratch — un rare aveu de reset dans un secteur habitué à la roadmap linéaire. Pour un intégrateur français, la question 2027 sera moins « quel LLM ? » que « quel modèle pour piloter mon bras robotisé ou mon agent bureautique full stack ? ».
Alibaba, Moonshot, DeepSeek : la vague open weights chinoise s'accélère en juillet
Juillet 2026 aura été le mois de la contre-offensive chinoise en open weights. Alibaba a publié Qwen3.7 Flash le 27 juillet 2026, itération rapide et économique de sa gamme. Moonshot a annoncé Kimi K3 le 17 juillet — 2,8 trilliards de paramètres, revendiqué « plus gros modèle open source du monde », avec ouverture complète des poids prévue en fin de mois. DeepSeek prépare V4-Pro autour de 1,6 T paramètres. Qwen3.7 Flash Kimi K3 La grille de lecture qui s'installe chez les analystes de marché : la Chine domine l'open weights, les États-Unis dominent le closed. Cette dichotomie a des conséquences pratiques immédiates. Un lab français qui monte un produit régulé — santé, finance, défense — a désormais un choix binaire à faire : payer 25 $ par million de tokens à Anthropic ou OpenAI et rester sur un contrat entreprise clair, ou faire tourner Qwen 3.7 ou Kimi K3 en local et poser un dossier de conformité solide sur l'origine des poids. La deuxième option devient réaliste techniquement — Ollama tourne maintenant nativement sur MLX sur Apple Silicon, vLLM v0.21.0 industrialise le serving avec batching continu et prefix caching — mais elle demande une équipe infra qui n'existait pas dans la stack SaaS classique. Question urgente à poser cette semaine à votre RSSI si vous envisagez cette bascule : quelle politique interne sur les modèles chinois hébergés en Europe, et quelle traçabilité des données d'entraînement quand elles ne sont pas documentées ?
Meta ferme la porte de Llama : 11 des 14 auteurs originaux sont partis
Le contraste avec la vague chinoise rend le retrait de Meta encore plus visible. Sur les 14 chercheurs signataires du papier Llama de 2023, 11 ont désormais quitté l'entreprise. Mark Zuckerberg a publiquement reconnu au début du mois de juillet 2026 que la roadmap agent de Meta est en retard sur le plan initial. Meta AI Plus discret mais plus structurel : Meta aurait acté au premier trimestre 2026 la fin de la stratégie open source pour la gamme Llama. Le successeur, nom de code interne « Avocado », se positionnerait en closed source commercialisé face à GPT-5 et Gemini 3 Ultra. Si cette bascule se confirme, elle ferme un chapitre de trois ans pendant lequel Llama a servi de socle par défaut à des milliers de startups et de projets internes. Les usages qui reposaient sur Llama 3 ou Llama 4 vont devoir migrer, avec deux voies possibles : basculer sur les alternatives chinoises Qwen ou DeepSeek — sujet géopolitique et compliance immédiat — ou rester dans l'écosystème occidental avec Mistral, qui reste le seul acteur européen crédible sur les poids ouverts. Mistral n'a pas fait d'annonce majeure en juillet, mais son positionnement se renforce mécaniquement : c'est le dernier grand producteur de poids ouverts hors Chine. À court terme, le grand perdant du mouvement Meta est le développeur indépendant qui construisait son produit sur un fine-tune Llama et se retrouve sans successeur naturel dans le même écosystème.
Cursor, Copilot, Claude Code : la guerre des IDE se stabilise à sept acteurs
Côté outillage développeur, le marché s'est stabilisé autour de sept acteurs sérieux : Claude Code, Google Antigravity, OpenAI Codex, Cursor, Kiro, GitHub Copilot et Windsurf — désormais rebaptisé Devin Desktop depuis le 2 juin 2026. Chaque outil occupe une position devenue lisible. Dev tools GitHub Copilot reste le défaut entreprise avec plus de 20 M d'utilisateurs, conformité SOC 2 et intégration native JetBrains, et se glisse dans les contrats Microsoft existants sans cycle d'achat séparé. Claude Code, sorti en 2025, a franchi 1 Md$ de revenu annualisé en six mois — chiffre exceptionnel pour un outil CLI. Cursor a été racheté par SpaceX pour 60 Md$ all-stock le 16 juin 2026, la plus grosse acquisition d'une startup VC de tous les temps, à environ 15× l'ARR de la société — un signal que le pricing des outils IA a atteint des multiples spéculatifs. Windsurf/Devin Desktop garde le rapport prix-fonctionnalités le plus intéressant pour le développeur indépendant à 20 $ par mois (relevé de 15 $ en mai 2026). Une lecture claire pour un CTO qui doit trancher aujourd'hui : Copilot pour la stack d'entreprise et la conformité, Cursor pour l'équipe produit qui veut de la génération IDE-native, Claude Code pour les workflows agentiques terminal-first. Le vrai débat n'est plus « quel outil ? » mais « comment mesurer le ROI par développeur ? » — et personne n'a de méthodologie publique convaincante sur ce point.
Infra : NVIDIA lève 25 Md$, AMD grimpe de 130 % en 2026
Sur l'infrastructure, NVIDIA a bouclé en juillet 2026 une émission obligataire de 25 Md$ pour financer la montée en cadence des systèmes Blackwell. Son GPU B200 est déjà en test client chez plusieurs hyperscalers, avec une disponibilité volume prévue au Q4 2026. Les délais du H200 sont retombés à 8-10 semaines pour la majorité des acheteurs entreprise, contre 14 à 18 semaines au printemps — signal que le goulot d'étranglement s'atténue. Infra AMD est le vrai surperformeur boursier du semestre : action en hausse de 130 % depuis le 1er janvier 2026, portée par la rotation des investisseurs vers un pari IA à valorisation plus raisonnable et par le succès de l'accord de partenariat MI300 avec OpenAI et Oracle. La MI325X d'AMD a trouvé une niche claire sur l'inférence à grande échelle, là où le coût par token compte plus que le throughput maximal brut. NVIDIA garde toutefois 70 à 80 % du marché des puces IA en volume et reste le fournisseur par défaut pour l'entraînement. Groq et Cerebras continuent à grignoter sur l'inférence à basse latence, mais aucune levée majeure ni annonce produit ce mois-ci. Point à retenir : la bataille infra 2026 se joue sur le coût par token en inférence, pas sur le pic de performance d'entraînement — ce qui explique pourquoi Together AI a bouclé 800 M$ le 1er juillet et pourquoi Baseten et Fireworks AI ont chacun levé 1,5 Md$ à mi-mois.
Testez votre lecture de la semaine
Quelle est la date pivot à laquelle les obligations socles de l'EU AI Act deviennent applicables à la majorité des systèmes IA opérant en Europe ?
Combien de modèles majeurs Anthropic a-t-il livrés entre début juin et fin juillet 2026 ?
Combien de paramètres revendique le modèle open source Kimi K3 de Moonshot annoncé en juillet 2026 ?
Quel montant Together AI a-t-il levé lors de sa série C bouclée le 1er juillet 2026 ?
Quel modèle Google DeepMind cible spécifiquement le contrôle « whole-body » d'humanoïdes et la coordination multi-robots ?