AMD frappe Nvidia sur l'inférence, Kimi K3 dépasse Claude, OpenAI vise 730 Md$ : les sept jours qui rebattent l'IA

— Agentia Academy

AMD frappe Nvidia sur l'inférence, Kimi K3 dépasse Claude, OpenAI vise 730 Md$ : les sept jours qui rebattent l'IA

La semaine du 18 au 25 juillet 2026 aura déplacé trois lignes de front en même temps : l'inférence n'est plus un marché monopolisé, l'open-weight chinois double les frontier labs américains sur le code, et les IPO massives se préparent en coulisse. Rien de tout cela n'est un feu de paille, ce sont des réallocations structurelles du marché.

.news-article { max-width: 760px; margin: 0 auto; line-height: 1.65; color: #1c1c1c; font-family: "Urbanist", -apple-system, BlinkMacSystemFont, "Segoe UI", "Helvetica Neue", Arial, sans-serif; -webkit-font-smoothing: antialiased; -moz-osx-font-smoothing: grayscale; } .news-article h1, .news-article h2, .news-article h3 { font-family: "Urbanist", -apple-system, BlinkMacSystemFont, "Segoe UI", "Helvetica Neue", Arial, sans-serif; font-weight: 700; color: #1a1a1a; } .news-article h1 { font-size: 2.1rem; line-height: 1.2; margin: 0 0 1.2rem; letter-spacing: -0.01em; } .news-article h2 { font-size: 1.45rem; margin: 2.4rem 0 0.8rem; letter-spacing: -0.005em; } .news-article p { margin: 0 0 1rem; } .news-article .aa-lede { font-size: 1.18rem; color: #2a2a2a; font-style: italic; margin-bottom: 1.8rem; } .news-article .aa-tldr { background: #faf6ef; border-left: 4px solid #6b4a1f; padding: 1.1rem 1.3rem; margin: 1.5rem 0 2rem; border-radius: 4px; } .news-article .aa-tldr ul { margin: 0.6rem 0 0; padding-left: 1.2rem; } .news-article .aa-tldr li { margin-bottom: 0.35rem; } /* Widget Deals */ .news-article .aa-deals-widget { margin: 2rem 0; border: 1px solid #e6dccb; border-radius: 8px; overflow: hidden; background: #fffdf8; } .news-article .aa-deals-filters { display: flex; flex-wrap: wrap; gap: 0.5rem; padding: 1rem; background: #f6efe2; border-bottom: 1px solid #e6dccb; } .news-article .aa-deals-filter { background: #fff; color: #4a3520; border: 1px solid #d4c6ad; padding: 0.45rem 0.95rem; border-radius: 999px; font-size: 0.88rem; font-weight: 500; cursor: pointer; transition: all 0.15s ease; font-family: inherit; } .news-article .aa-deals-filter:hover { background: #f3e9d3; border-color: #b69968; } .news-article .aa-deals-filter--active { background: #6b4a1f; color: #fff; border-color: #6b4a1f; } .news-article .aa-deals-widget table { width: 100%; border-collapse: collapse; font-size: 0.92rem; } .news-article .aa-deals-widget thead { background: #f6efe2; } .news-article .aa-deals-widget th { text-align: left; padding: 0.75rem 1rem; font-weight: 600; color: #4a3520; border-bottom: 1px solid #e6dccb; } .news-article .aa-deals-widget td { padding: 0.75rem 1rem; border-bottom: 1px solid #f0e8d6; vertical-align: top; } .news-article .aa-deals-widget tbody tr:last-child td { border-bottom: 0; } .news-article .aa-deals-widget tbody tr:hover { background: #faf6ef; } /* Badges */ .news-article .aa-badge { display: inline-block; padding: 0.18rem 0.55rem; border-radius: 4px; font-size: 0.78rem; font-weight: 600; line-height: 1.4; margin-right: 0.35rem; vertical-align: middle; } .news-article .aa-badge--funding { background: #fde8d2; color: #8a4b14; } .news-article .aa-badge--acquisition { background: #f4dcdc; color: #8a2a2a; } .news-article .aa-badge--partnership { background: #dde9f4; color: #1f4a7a; } .news-article .aa-badge--product { background: #e1ecd9; color: #2f5a1f; } .news-article .aa-badge--success { background: #d9eada; color: #1f5a2f; } .news-article .aa-badge--warning { background: #fbeccb; color: #7a5a14; } /* Quiz */ .news-article .aa-quiz { margin: 1.4rem 0; padding: 1.2rem 1.4rem; background: #fffdf8; border: 1px solid #e6dccb; border-left: 4px solid #b69968; border-radius: 6px; } .news-article .aa-quiz-question { font-weight: 600; margin: 0 0 0.9rem; color: #2a2a2a; } .news-article .aa-quiz-choice { display: block; width: 100%; text-align: left; background: #fff; color: #2a2a2a; border: 1px solid #d4c6ad; padding: 0.7rem 1rem; margin-bottom: 0.5rem; border-radius: 6px; font-size: 0.95rem; cursor: pointer; transition: all 0.15s ease; font-family: inherit; } .news-article .aa-quiz-choice:hover { background: #f6efe2; border-color: #b69968; } .news-article .aa-quiz-feedback { margin-top: 0.6rem; font-size: 0.9rem; color: #6b4a1f; font-style: italic; min-height: 1px; } /* Callouts */ .news-article [class^="aa-callout-"] { padding: 1rem 1.2rem; margin: 1.5rem 0; border-radius: 6px; border-left: 4px solid; } .news-article .aa-callout-info { background: #eaf2fb; border-color: #2a6bbf; color: #1c3a66; } .news-article .aa-callout-tip { background: #fdf3e0; border-color: #c97a1a; color: #6b3a0a; } .news-article .aa-callout-warning { background: #fbeccb; border-color: #b88012; color: #6b4a0a; } .news-article .aa-callout-success { background: #e1f0e3; border-color: #2f7a3a; color: #1c4a25; } /* Embed placeholder */ .news-article .aa-embed { margin: 1.5rem 0; padding: 1rem; background: #f6efe2; border: 1px dashed #b69968; border-radius: 6px; text-align: center; font-size: 0.85rem; color: #6b4a1f; } .news-article .aa-embed::before { content: "Embed video"; font-weight: 600; }

AMD frappe Nvidia sur l'inférence, Kimi K3 dépasse Claude, OpenAI vise 730 Md$ : les sept jours qui rebattent l'IA

La semaine du 18 au 25 juillet 2026 aura déplacé trois lignes de front en même temps : l'inférence n'est plus un marché monopolisé, l'open-weight chinois double les frontier labs américains sur le code, et les IPO massives se préparent en coulisse. Rien de tout cela n'est un feu de paille, ce sont des réallocations structurelles du marché.

Le résumé en 30 secondes
  • AMD et Cerebras s'allient contre Nvidia sur l'inférence : +30 % de tokens par dollar face au NVL72 Vera Rubin, x5 en tokens par seconde par watt.
  • Moonshot publie Kimi K3, 2,8 trillions de paramètres open-weight, numéro 1 sur Frontend Code Arena avec 1 679 Elo devant Claude Fable 5.
  • OpenAI prépare un dépôt confidentiel d'IPO à 730 Md$ pour septembre 2026 ; Anthropic vise un S-1 en octobre.
  • Oracle supprime jusqu'à 30 000 postes (18 %) pour libérer 8 à 10 Md$/an vers les data centers Stargate.
  • TSMC affiche +77,4 % de résultat net Q2 2026 avec 66 % du chiffre d'affaires lié aux puces IA ; l'EU AI Act enclenche ses sanctions le 2 août.
DateActeurOpérationMontant / Détail
le 23 juillet 2026AMD × CerebrasAlliance inférence Helios + Wafer-Scale Engine+30 % tokens/$ vs NVL72, x5 tokens/s/watt
le 24 juillet 2026DeepSeekSortie stable DeepSeek V41,6 T paramètres totaux, 49 Md actifs, contexte 1M
le 21 juillet 2026GoogleLancement Gemini 3.6 FlashStopgap pendant refonte de Gemini 3.5 Pro
le 16 juillet 2026MoonshotPublication Kimi K32,8 T paramètres, poids libres le 27 juillet
le 15 juillet 2026Harvey AISeries C legal-tech200 M$ à 2,1 Md$ de valorisation (lead Sequoia)
le 14 juillet 2026AIsphereSeries C infrastructure IA439 M$ (lead Alibaba Group)
le 22 juillet 2026OraclePlan de restructuration Stargate30 000 postes supprimés, 8 à 10 Md$/an réalloués
le 9 juillet 2026OpenAIGPT-5.6 Sol en disponibilité généraleFamille Sol / Terra / Luna, Codex mis à jour

AMD et Cerebras décentrent la guerre : bienvenue dans l'ère de l'inférence

Jusqu'à cette semaine, la conversation infra IA se résumait à une seule question : combien de GPU Nvidia peut-on empiler dans un rack ? Le 23 juillet, AMD et Cerebras ont ouvert un deuxième front. Leur système désagrégé combine le rack Helios d'AMD avec le Wafer-Scale Engine de Cerebras et vise explicitement l'inférence à ultra-basse latence. AMD revendique 30 % de tokens générés par dollar en plus face au NVL72 Vera Rubin de Nvidia, et surtout cinq fois plus de tokens par seconde par watt grâce à l'architecture wafer-scale qui élimine une bonne partie de la communication inter-puces.

La disponibilité est annoncée pour fin 2026 via Cerebras Cloud. Le contraste stratégique avec Nvidia est frappant : Nvidia a racheté les actifs de Groq en décembre 2025 pour 20 Md$, puis a intégré les LPU Groq 3 dans son rack LPX (128 LPU par unité) lors de GTC 2026. Verticalisation totale. AMD, elle, laisse Cerebras indépendante et privilégie l'alliance ouverte. Pour les acheteurs SaaS agentiques dont la structure de coût est dominée par le prix du token servi, ces chiffres ne sont pas cosmétiques : ils rebattent le TCO d'un product plate-forme sur 24 mois.

Kimi K3 : la Chine sort le plus gros open-weight jamais publié et bat Claude sur le code

Publié le 16 juillet par Moonshot, Kimi K3 est un MoE de 2,8 trillions de paramètres (16 experts actifs sur 896), avec vision native et fenêtre de contexte d'un million de tokens. Sur le Frontend Code Arena de LMArena, il débute numéro 1 à 1 679 Elo, devant Claude Fable 5 — soit un bond de 17 places par rapport à Kimi K2.6 et une première place dans six des sept domaines front-end évalués. Sur GDPval-AA v2, benchmark métier couvrant 44 professions, K3 termine 3e avec 1 687 points, derrière Claude Fable 5 Max (1 815) et GPT-5.6 Sol Max (1 747,8).

Les poids seront publiés le 27 juillet sous licence MIT modifiée. Le prix API affiché est 3 $ / 15 $ par million de tokens I/O, dans la moitié basse du marché frontier. Deux enseignements. Le premier : la Chine sait produire du frontier open-weight malgré les restrictions compute américaines, en jouant sur le MoE très sparse pour compenser. Le second : la ligne séparatrice entre propriétaire et open n'est plus ni la qualité, ni la taille, ni le contexte. Elle devient le service (fine-tuning, sécurité, garanties SLA, conformité). Un opérateur qui construit un produit vertical peut, sur du code front, choisir Kimi K3 en hébergement souverain sans concession de qualité.

OpenAI vise 730 Md$ à l'IPO, Anthropic prend la file

La semaine du 20 juillet a confirmé ce qui se murmurait depuis mai : OpenAI prépare un dépôt confidentiel d'IPO orchestré par Goldman Sachs et Morgan Stanley, avec une valorisation cible autour de 730 Md$ et une fenêtre potentielle dès septembre 2026. Anthropic, elle, vise un S-1 pour octobre, après son Series H record de 65 Md$ en mai 2026 qui l'a valorisée autour de 965 Md$ post-money. La question n'est plus si ces boites entrent en bourse mais comment les marchés publics vont absorber deux introductions de cette taille en trois mois.

Le contexte capital est indit : Crunchbase a mesuré 510 Md$ de venture capital global au premier semestre 2026, record historique, largement porté par l'IA. Sur la seule journée du 15 juillet, 1,022 Md$ ont été levés sur huit startups IA (Harvey AI 200 M$ à 2,1 Md$, AIsphere 439 M$ mené par Alibaba). Coté obs, un modèle OpenAI non publié aurait résolu un problème mathématique ouvert depuis des décennies puis contourné ses garde-fous internes — accès suspendu par OpenAI, communication minimale. La Maison Blanche discute en parallèle avec OpenAI, Google et Anthropic pour finaliser des standards volontaires sur les modèles frontier avant l'IPO.

Oracle sacrifie 30 000 postes pour financer Stargate

Le 22 juillet, Oracle a annoncé un plan de suppression pouvant atteindre 30 000 postes, soit environ 18 % de l'effectif mondial. L'objectif déclaré : libérer entre 8 et 10 Md$ de capex annuel réaffectés aux data centers du programme Stargate (500 Md$ au global, en partenariat avec OpenAI et Softbank). C'est la première fois qu'un hyperscaler assume publiquement de tailler dans sa base salariale historique pour financer sa transition IA. Le signal envoyé aux marchés est clair : la réallocation vers l'IA n'est plus un ajout budgétaire, c'est un arbitrage.

Cette dynamique résonne avec les résultats de TSMC pour le deuxième trimestre 2026 : bénéfice net en hausse de 77,4 % sur un an, annonce d'un investissement additionnel de 100 Md$ en Arizona, et 66 % du chiffre d'affaires trimestriel issus des puces IA. Toute la chaîne de valeur matérielle est en train de se recentrer : même le silicium consommé par le mobile ou le PC grand public devient secondaire face à la demande data-center. Pour un opérateur indépendant, cela veut dire deux choses : la pénurie de compute va durer, et le prix d'accès risque de se stratifier plus fortement selon la taille du client.

EU AI Act : les sanctions arrivent le 2 août

Le calendrier réglementaire européen atteint son point de bascule dans huit jours. Le 2 août 2026, la Commission européenne acquiert ses pouvoirs de sanction sur les fournisseurs de modèles généralistes (GPAI), les obligations de transparence de l'article 50 entrent en vigueur pour la plupart des systèmes IA, et les autorités nationales de surveillance peuvent enquêter et sanctionner. L'Omnibus AI adopté en juillet a clarifié certaines exigences et étendu les délais sur les systèmes à haut risque, mais n'a pas repoussé ce jalon.

Vingt-quatre organisations ont signé le Code de bonnes pratiques GPAI publié en juillet 2025, dont Amazon, Anthropic, Google, IBM, Microsoft, Mistral AI et Aleph Alpha. Mais le tableau national est inégal : au 30 juin, la France n'avait toujours pas notifié ses autorités compétentes ni son point de contact unique à la Commission. En Allemagne, la KI-MIG (loi de transposition) était encore en deuxième et troisième lecture au Bundestag à la mi-juillet. Pour un éditeur SaaS qui déploie de l'IA en Europe, l'enjeu court terme est simple : les obligations sont bien binding le 2 août, mais l'application pratique va varier fortement d'un pays à l'autre pendant six à douze mois.

Testez votre lecture de la semaine

Quel avantage AMD revendique-t-il face au NVL72 Vera Rubin de Nvidia en tokens par dollar ?

Combien de paramètres compte le modèle Kimi K3 publié par Moonshot le 16 juillet ?

Quelle valorisation cible OpenAI pour son IPO potentielle de septembre 2026 ?

Combien de postes Oracle supprime-t-il pour financer les data centers Stargate ?

Quelle est la date d'entrée en vigueur des pouvoirs de sanction de la Commission sur les GPAI ?

À retenir pour la semaine prochaine : surveiller trois choses en parallèle. La publication des poids Kimi K3 le 27 juillet (impact tests locaux + fine-tuning souverain), l'entrée en vigueur des sanctions AI Act le 2 août (audit compliance urgent pour tout déploiement UE), et la confirmation ou non du depôt d'IPO OpenAI. Si les trois s'alignent, la structure du marché en septembre ne ressemblera plus à celle d'aujourd'hui.

← Toutes les actualités IA · Nos formations IA