AI Act, Opus 5 et Cursor à 60 Md#160;: la semaine qui redistribue les cartes de l’IA
Le 2 août 2026, l’Europe a commencé à faire appliquer l’AI Act. Pendant ce temps, Anthropic sort Opus 5 à moitié prix, xAI absorbe Cursor pour 60 Md$, et AMD affiche +50% de croissance. Une semaine où l’IA cesse d’être un pari de labo pour devenir une industrie régulée, cash–flow positive et géopolitique.
- L’Article 50 de l’AI Act s’applique depuis le 2 août 2026 : transparence obligatoire sur chatbots, contenus générés et GPAI, amendes jusqu’à 15 M€ ou 3% du CA mondial.
- Anthropic sort Claude Opus 5 le 24 juillet 2026 à environ 50% du prix de Fable 5, avec un « effort dial » pour arbitrer coût contre capacité.
- Google Gemini 3.6 Flash (21 juillet 2026) et GPT–5.6 Sol/Terra/Luna d’OpenAI compressent les prix sur le milieu de gamme.
- SpaceX finalise le rachat de Cursor (Anysphere) pour 60 Md$ en actions : plus grosse acquisition VC–backed de l’histoire, xAI récupère un IDE et 4 Md$ d’ARR.
- AMD publie 11,5 Md$ de CA au Q2 (+50% YoY), le data center double, et rachète Taalas pour attaquer l’inference software.
AI Act, Article 50 : ce qui change vraiment le 2 août 2026
Depuis le 2 août 2026, l’AI Office de la Commission européenne, adossé aux autorités nationales, applique effectivement l’Article 50 de l’AI Act. Trois obligations concrètes tombent en même temps : signaler qu’un utilisateur interagit avec un système d’IA (fin des chatbots muets sur leur nature), labelliser les contenus synthétiques et deepfakes de façon lisible par machine, et documenter les modèles à usage général (GPAI) pour les déployeurs en aval.
Le régime de sanctions est nouveau : jusqu’à 15 M€ ou 3% du chiffre d’affaires mondial, selon le plus élevé. Le Digital Omnibus adopté en juillet a repoussé l’essentiel des obligations à haut risque de l’Annexe III au 2 décembre 2027, et celles concernant l’IA embarquée dans des produits déjà régulés au 2 août 2028. Ce qui commence maintenant, c’est surtout de la conformité produit : metadata C2PA sur les images générées, mentions in–app sur les assistants, model cards standardisées pour Llama, Mistral, DeepSeek, Qwen ou Kimi lorsqu’ils sont distribués dans l’UE.
Pour un builder européen, la ligne pratique est simple : si votre produit intègre une API OpenAI, Anthropic, Google ou Mistral, la responsabilité de transparence remonte partiellement au déployeur. Une note de bas de conversation et un audit du prompt système suffisent, mais leur absence est désormais opposable.
Opus 5, Gemini 3.6 Flash, GPT–5.6 : la course au moitié–prix
Anthropic a lancé Claude Opus 5 le 24 juillet 2026. Le modèle vise les performances de Fable 5 (leur top absolu) pour environ 50% du coût par token, et devient le défaut sur Claude Max. Nouveauté produit : un « effort dial » qui permet d’arbitrer explicitement entre latence, coût et qualité de raisonnement, là où OpenAI a déjà tranché avec ses variantes Sol, Terra et Luna de GPT–5.6.
Google a de son côté sorti Gemini 3.6 Flash le 21 juillet, positionné en workhorse plus rapide et moins cher que 3.5 Flash. Il alimente déjà Antigravity 2.0, la brique agent de Google, et l’appli Gemini grand public. La consolidation est nette : les trois frontier labs propriétaires poussent tous des tiers « milieu de gamme » qui étaient encore inatteignables il y a douze mois à ce niveau de prix.
Conséquence pour les équipes produit : le coût moyen d’un million de tokens de sortie sur un modèle utile en production a été divisé par un facteur 4 à 6 depuis début 2025. Ce n’est pas une rupture technologique, c’est une bascule économique : certaines features d’IA jusque–là interdites par la marge deviennent viables, même à grande échelle B2C.
Cursor racheté 60 Md#160;: xAI change de stratégie
Le 16 juin 2026, quatre jours après son IPO, SpaceX a exercé une option signée en avril et absorbé Anysphere, la maison mère de Cursor, pour 60 Md$ en actions. C’est la plus grosse acquisition d’une startup VC–backed de l’histoire, environ 15x l’ARR annualisé de Cursor (~4 Md$). Musk avait fusionné xAI et SpaceX plus tôt dans l’année ; ce deal donne à xAI un canal de distribution direct chez les développeurs, là où Grok peinait à s’imposer face à Claude Sonnet 5 et GPT–5.6.
La lecture stratégique : xAI achète du temps et un marché captif plutôt qu’un modèle. Cursor 3 vient de casser la limite « un agent à la fois », Windsurf est devenu Devin Desktop dans l’orbite Google, et GitHub Copilot pousse un plan Max à 100$/mois avec ~42% de part de marché. Le jeu se referme autour de trois à quatre plateformes.
Question ouverte : la rétention des ingénieurs Anysphere sur trois ans conditionnera l’essentiel de la valeur. Historiquement, les acquisitions à ce prix–là perdent 30 à 60% de leur équipe fondatrice dans les 24 mois. Si xAI ne verrouille pas la culture, le deal deviendra une pure jouerie de distribution.
Meta, ByteDance et la vidéo générative : le vrai front chaud
Pendant que la presse commente les LLM, la vidéo générative est passée en itération industrielle. ByteDance a publié Seedance 2.5 le 8 août 2026, quelques semaines après Seedance 2.0. Meta a sorti Muse Spark 1.2 le 6 août. Sora 2 (OpenAI), Veo 3 (Google) et Kling 2 (Kuaishou) itèrent tous les 4 à 6 semaines. Le rythme est celui du mobile en 2014.
Meta occupe une position particulière : après le pivot vers Superintelligence Labs, l’entreprise ne semble plus courir après un frontier LLM propriétaire, mais concentre ses releases sur des outils créatifs intégrables à Instagram, WhatsApp et Reality Labs. Muse Spark 1.2 est la troisième itération en cinq mois, avec un focus assumé sur la latence sub–seconde plutôt que sur la qualité cinématographique brute.
Pour un créateur ou une agence, l’arbitrage change : Sora 2 reste le meilleur pour du narratif long (>20 s), Kling et Seedance dominent le court–format publicitaire, Veo 3 sort du lot sur la cohérence multi–plan. Aucun n’est encore fiable à 100%, mais la moyenne des essais utiles est passée de 1 sur 10 à environ 4 sur 10 en douze mois.
Open source et local : Ollama+MLX rattrape le retard sur Mac
Côté poids ouverts et inference locale, la semaine se joue en sourdine mais compte. Ollama tourne désormais sur un backend MLX natif sur Apple Silicon, en complément de llama.cpp. Sur un M4 Max, cela représente typiquement +30 à +50% de tokens/seconde selon les modèles Qwen 3.6 Plus, Kimi K2.6 ou DeepSeek V4 quantifiés.
LM Studio, gratuit pour l’usage personnel et commercial depuis juillet 2025, garde l’avantage sur l’UX et le catalogue. vLLM v0.21.0 reste la référence production self–hosted : PagedAttention, Apache 2.0, environ 3x le throughput d’Ollama sous charge concurrente. La grille pratique en 2026 est stable : Ollama ou LM Studio pour un poste unique, vLLM ou SGLang pour du multi–utilisateur.
Pour un indépendant ou une PME, cela veut dire une chose : un modèle open–weights de 30 à 70 milliards de paramètres tourne aujourd’hui sur un Mac à 4 000 €, avec une qualité qui couvre 80% des cas d’usage internes (résumé, extraction, classification, code moyen). Le reste peut passer sur API. La question « on part cloud ou on part local » n’a plus une seule bonne réponse.
AMD, la seule alternative crédible à NVIDIA
AMD a publié ses résultats du Q2 2026 : 11,5 Md$ de chiffre d’affaires, +50% en glissement annuel, avec un data center qui plus que double. L’acquisition de Taalas, startup d’inference AI, prolonge la stratégie ROCm et vise clairement à combler l’écart logiciel avec CUDA. Samsung et SK Hynix, de leur côté, ont dévoilé des architectures « zHBM » (stacking vertical) et un standard HBF pour débloquer le goulot mémoire.
NVIDIA reste dominant, mais AMD Instinct est désormais qualifié chez plusieurs hyperscalers, et la pénurie de GPU déplace la demande vers tout ce qui accepte du CUDA–compat. Groq et Cerebras continuent leur niche inference à très basse latence. La dépendance mono–fournisseur du secteur commence à se fissurer, non par choix technique, mais par manque de disponibilité.
Testez votre lecture de la semaine
Depuis quelle date l’Article 50 de l’AI Act est–il effectivement appliqué par la Commission européenne ?
Quel est le montant maximal d’amende prévu par l’Article 50 en cas de non–conformité ?
Combien SpaceX a–t–il payé pour racheter Cursor (Anysphere) ?
Quelle nouveauté produit accompagne le lancement de Claude Opus 5 ?
Quel avantage technique Ollama vient–il de gagner sur Apple Silicon ?