Opus 5, GPT-5.6 Luna, Kimi K3 : la semaine où le prix a rejoint la puissance
Trois modèles frontier ont bougé les lignes en sept jours, un labo chinois a sorti le plus gros open-weight jamais publié, AMD est devenu actionnaire de son propre client, et l'Europe a envoyé sa première amende à huit chiffres. Le paysage IA de fin juillet 2026 est moins un feu d'artifice qu'une redistribution silencieuse des cartes.
- Anthropic ship Claude Opus 5 le 24 juillet 2026, contexte 1 M tokens, prix identique à Opus 4.8.
- OpenAI casse le prix de GPT-5.6 Luna de 80% le 30 juillet, réponse directe à la pression open source.
- Moonshot publie Kimi K3, 2,8 trillion de paramètres open-weight, premier modèle chinois à battre Claude Fable 5 sur Frontend Code Arena.
- AMD investit jusqu'à 5 Md$ dans Anthropic contre 2 GW de GPU Instinct MI450, renversement fournisseur/actionnaire.
- L'EU AI Act est entré en application le 10 juillet, première amende à 45 M€ contre une entreprise allemande.
Claude Opus 5 : Anthropic tient son prix, ce qui est un choix stratégique
Le 24 juillet 2026, Anthropic a mis en ligne ProduitClaude Opus 5 sur l'ensemble de ses surfaces : API (claude-opus-5), claude.ai (Pro, Max, Team, Enterprise), Amazon Bedrock, Google Cloud et Microsoft Foundry. Le modèle affiche une fenêtre de contexte de 1 M tokens, jusqu'à 128 000 tokens de sortie synchrone, un contrôle d'effort à cinq niveaux, et un score de 100% au Needle in a Haystack quel que soit l'emplacement de l'information cible dans le contexte.
Sur Frontier-Bench v0.1, Opus 5 double le score d'Opus 4.8 et surpasse tous les autres modèles testés. Sur ARC-AGI 3, il triple le score du deuxième. Sur OSWorld 2.0 il dépasse Claude Fable 5 pour un tiers du coût par tâche. Sur CursorBench 3.2, il reste à moins de 0,5% du pic de Fable 5, à moitié prix.
La vraie décision produit est ailleurs : le tarif reste identique à Opus 4.8, soit 5$ / 25$ par million de tokens en entrée / sortie. À l'heure où OpenAI vient de baisser Luna de 80%, Anthropic assume de garder son ticket flagship stable — pari clair que la couche entreprise, où l'écart de qualité compte plus que quelques cents par million de tokens, restera captive. Un mode Fast à ~2,5× la vitesse est proposé à 10$ / 50$ pour ceux qui veulent trader latence contre prix.
Kimi K3 : la Chine passe la barre des 3 trillion de paramètres en open-weight
Moonshot AI a publié Kimi K3 le 16 juillet 2026, avec les poids complets livrés le 26 juillet, un jour avant la date annoncée du 27. C'est le premier modèle open-weight à franchir la barre des 3 trillion de paramètres — 2,8 T précisément, en Mixture-of-Experts qui active 16 experts sur 896 par requête. Le modèle embarque un contexte de 1 M tokens, une compréhension visuelle native, et une quantization MXFP4 qui permet l'hébergement dès le jour de sortie sur les plateformes tierces.
Sur Frontend Code Arena, Kimi K3 devance Claude Fable 5 — première fois qu'un open-weight chinois passe devant un flagship américain sur ce benchmark. Moonshot reconnaît trois zones où le modèle traîne : sensibilité à l'historique de raisonnement, sur-proactivité dans les scénarios ambigus, et un écart d'UX subjectif qui reste au bénéfice de Fable 5 et GPT-5.6 Sol.
Le signal politico-industriel dépasse le modèle lui-même. Les restrictions d'export US sur les GPU haut de gamme étaient censées ralentir la Chine ; elles ont accéléré son basculement stratégique vers l'open source, où la Chine assume désormais le rôle de fournisseur de poids ouverts au monde entier. Pour un CTO européen, ça change concrètement l'arbitrage build vs buy : héberger Kimi K3 en interne coûte l'infra, mais évite la dépendance à un API frontier US.
AMD ↔ Anthropic : quand le fournisseur devient actionnaire
PartenariatLe 22 juillet 2026, AMD et Anthropic ont annoncé un accord à double détente : jusqu'à 2 gigawatts de GPU Instinct MI450 déployés côté Anthropic, et jusqu'à 5 Md$ d'investissement equity d'AMD dans Anthropic, verrouillés sur des jalons de déploiement. Premier gigawatt attendu au premier semestre 2027, dans des racks Helios avec CPU EPYC Venice, réseau Pensando et stack ROCm.
La structure du deal tranche avec le précédent AMD/OpenAI, où AMD avait cédé à OpenAI des warrants pouvant représenter jusqu'à 10% de son propre capital. Ici, AMD met de l'argent chez son client au lieu d'en donner. C'est une réponse assumée aux critiques d'analystes qui pointaient une dilution structurelle du modèle warrants.
Deux effets secondaires notables. Un, Claude sera activement utilisé pour optimiser les workloads sur GPU AMD et accélérer ROCm — ROCm reste le talon d'Achille d'AMD face au CUDA de Nvidia, et cette boucle produit peut resserrer l'écart. Deux, AMD adopte largement Claude en interne pour ses équipes engineering et produit, signal fort de mainstreaming des agents de code dans les grandes tech companies. Nvidia n'a plus le monopole des méga-deals compute ; le marché de l'IA infra n'est plus binaire.
GPT-5.6 Luna : OpenAI casse les prix pour tenir le milieu de gamme
Sorti le 9 juillet 2026, GPT-5.6 se décline en trois tiers persistants : Sol (flagship, 5$ / 30$ per MTok), Terra (équivalent GPT-5.5, 2,50$ / 15$), Luna (rapide et bon marché, 1$ / 6$ à la sortie). Le naming — Sol, Terra, Luna — est explicitement pensé comme des paliers de capacité qui peuvent évoluer à leur propre rythme, sans forcer une renumérotation à chaque itération.
La nouvelle qui compte pour cette semaine du 31 juillet est la baisse annoncée le 30 : Luna voit son prix chuter de 80%, Terra de 20%. Le signal est clair : OpenAI protège son milieu de marché contre Kimi K3 et Qwen 3.7 Flash, qui rendent le tier Luna d'origine non compétitif sur des workflows agentiques haute cadence.
Sam Altman a mis en avant sur CNBC que Sol serait 54% plus token-efficient sur le coding agentique — chiffre à prendre avec des pincettes tant qu'il n'est pas mesuré publiquement sur des benchmarks reproductibles. La sortie s'accompagne de ChatGPT Work, un agent packagé pour exécuter des jobs de bout-en-bout, positionné frontal contre Claude Code et Devin Desktop (ex-Windsurf, rebaptisé le 2 juin 2026). La bataille des agents grand public entre dans sa phase produit.
EU AI Act : les premières amendes tombent, 45 M€ en Allemagne
RégulationLe 10 juillet 2026, l'application effective de l'EU AI Act a démarré. Les obligations de disclosure des chatbots sont désormais live : toute entreprise qui déploie un système conversationnel en contact avec un utilisateur européen doit indiquer explicitement qu'il s'agit d'une IA. Première sanction record : 45 M€ contre une entreprise allemande non nommée, pour erreurs dans les données d'entraînement.
Deadline suivante déjà en vue : le 2 août 2026 marque l'entrée en vigueur stricte de l'Article 50 sur la transparence des modèles à usage général et du media synthétique. Le plafond des amendes monte à 15 M€ ou 3% du chiffre d'affaires mondial, selon le plus élevé. Les grands modèles générant du texte, de l'image ou de la vidéo doivent techniquement watermarker leurs sorties de façon détectable — condition que peu de plateformes tiennent aujourd'hui bout à bout.
Un AI Omnibus voté en mai 2026 est également entré en vigueur en juillet, et un plan d'action Cybersécurité + IA a été publié pour aider États membres et opérateurs privés à absorber la vague. Le décalage entre le rythme régulatoire européen et la vitesse des labs frontier n'est pas résolu, mais l'ère du "AI Act de papier" est fermée : la première amende à huit chiffres a été prononcée, il y aura les suivantes.
Deals et M&A : SpaceX absorbe Cursor, H1 2026 clôt à 510 Md$
AcquisitionLe 16 juin 2026, SpaceX a racheté Anysphere, l'éditeur de Cursor, pour 60 Md$ en actions — record absolu d'acquisition d'une startup VC-backed, soit environ 15 fois l'ARR annualisé (~4 Md$) de Cursor à la date du deal. L'opération suit l'IPO de SpaceX plus tôt en juin. Elle repose la question de fond : que fait un opérateur d'infrastructure spatiale avec un IDE codé sur VS Code ?
Côté levées, OpenAI a bouclé un tour de 110 Md$ à une valorisation de 730 Md$, Shield AI a levé 1,5 Md$ en Série G à une valo de 12,7 Md$, et Baseten comme Fireworks AI ont chacune levé 1,5 Md$ pour financer leur bataille sur l'inference enterprise. Le funding startups mondial du premier semestre 2026 atteint 510 Md$ selon Crunchbase, un record poussé quasi intégralement par l'IA.
Les moyennes cachent une concentration extrême : 88% du funding IA reste aux US, les valorisations moyennes progressent de 40% quarter-over-quarter à 280 M$, et une poignée de VCs (Sequoia, Index, Andreessen Horowitz) capte l'essentiel du deal flow. Pour l'écosystème européen, la fenêtre "champion IA continental" continue de se refermer sans qu'aucun acteur ne soit encore parvenu à casser la logique de gravité américaine.
Testez votre lecture de la semaine
Quelle est la fenêtre de contexte de Claude Opus 5 ?
Combien de paramètres compte Kimi K3, le nouveau modèle open-weight de Moonshot ?
Que reçoit AMD en échange de son investissement dans Anthropic ?
De combien OpenAI a-t-il réduit le prix de GPT-5.6 Luna le 30 juillet 2026 ?
Quel montant SpaceX a-t-il payé pour racheter Anysphere (Cursor) ?