Kimi K3 arrive demain en open weights. Et Washington menace Moonshot de sanctions.

— Agentia Academy

Kimi K3 arrive demain en open weights. Et Washington menace Moonshot de sanctions.

Une semaine où le plus gros modèle open weight de l’histoire (2 800 milliards de paramètres) devient un incident diplomatique, où Black Forest Labs unifie image, vidéo, audio et robotique dans un seul réseau, et où Google sort trois modèles Flash le même jour. La cadence est le nouveau moat.

.news-article { max-width: 760px; margin: 0 auto; line-height: 1.65; color: #1c1c1c; font-family: "Urbanist", -apple-system, BlinkMacSystemFont, "Segoe UI", "Helvetica Neue", Arial, sans-serif; -webkit-font-smoothing: antialiased; -moz-osx-font-smoothing: grayscale; } .news-article h1, .news-article h2, .news-article h3 { font-family: "Urbanist", -apple-system, BlinkMacSystemFont, "Segoe UI", "Helvetica Neue", Arial, sans-serif; font-weight: 700; color: #1a1a1a; } .news-article h1 { font-size: 2.1rem; line-height: 1.2; margin: 0 0 1.2rem; letter-spacing: -0.01em; } .news-article h2 { font-size: 1.45rem; margin: 2.4rem 0 0.8rem; letter-spacing: -0.005em; } .news-article p { margin: 0 0 1rem; } .news-article .aa-lede { font-size: 1.18rem; color: #2a2a2a; font-style: italic; margin-bottom: 1.8rem; } .news-article .aa-tldr { background: #faf6ef; border-left: 4px solid #6b4a1f; padding: 1.1rem 1.3rem; margin: 1.5rem 0 2rem; border-radius: 4px; } .news-article .aa-tldr ul { margin: 0.6rem 0 0; padding-left: 1.2rem; } .news-article .aa-tldr li { margin-bottom: 0.35rem; } /* Widget Deals */ .news-article .aa-deals-widget { margin: 2rem 0; border: 1px solid #e6dccb; border-radius: 8px; overflow: hidden; background: #fffdf8; } .news-article .aa-deals-filters { display: flex; flex-wrap: wrap; gap: 0.5rem; padding: 1rem; background: #f6efe2; border-bottom: 1px solid #e6dccb; } .news-article .aa-deals-filter { background: #fff; color: #4a3520; border: 1px solid #d4c6ad; padding: 0.45rem 0.95rem; border-radius: 999px; font-size: 0.88rem; font-weight: 500; cursor: pointer; transition: all 0.15s ease; font-family: inherit; } .news-article .aa-deals-filter:hover { background: #f3e9d3; border-color: #b69968; } .news-article .aa-deals-filter--active { background: #6b4a1f; color: #fff; border-color: #6b4a1f; } .news-article .aa-deals-widget table { width: 100%; border-collapse: collapse; font-size: 0.92rem; } .news-article .aa-deals-widget thead { background: #f6efe2; } .news-article .aa-deals-widget th { text-align: left; padding: 0.75rem 1rem; font-weight: 600; color: #4a3520; border-bottom: 1px solid #e6dccb; } .news-article .aa-deals-widget td { padding: 0.75rem 1rem; border-bottom: 1px solid #f0e8d6; vertical-align: top; } .news-article .aa-deals-widget tbody tr:last-child td { border-bottom: 0; } .news-article .aa-deals-widget tbody tr:hover { background: #faf6ef; } /* Badges */ .news-article .aa-badge { display: inline-block; padding: 0.18rem 0.55rem; border-radius: 4px; font-size: 0.78rem; font-weight: 600; line-height: 1.4; margin-right: 0.35rem; vertical-align: middle; } .news-article .aa-badge--funding { background: #fde8d2; color: #8a4b14; } .news-article .aa-badge--acquisition { background: #f4dcdc; color: #8a2a2a; } .news-article .aa-badge--partnership { background: #dde9f4; color: #1f4a7a; } .news-article .aa-badge--product { background: #e1ecd9; color: #2f5a1f; } .news-article .aa-badge--success { background: #d9eada; color: #1f5a2f; } .news-article .aa-badge--warning { background: #fbeccb; color: #7a5a14; } /* Quiz */ .news-article .aa-quiz { margin: 1.4rem 0; padding: 1.2rem 1.4rem; background: #fffdf8; border: 1px solid #e6dccb; border-left: 4px solid #b69968; border-radius: 6px; } .news-article .aa-quiz-question { font-weight: 600; margin: 0 0 0.9rem; color: #2a2a2a; } .news-article .aa-quiz-choice { display: block; width: 100%; text-align: left; background: #fff; color: #2a2a2a; border: 1px solid #d4c6ad; padding: 0.7rem 1rem; margin-bottom: 0.5rem; border-radius: 6px; font-size: 0.95rem; cursor: pointer; transition: all 0.15s ease; font-family: inherit; } .news-article .aa-quiz-choice:hover { background: #f6efe2; border-color: #b69968; } .news-article .aa-quiz-feedback { margin-top: 0.6rem; font-size: 0.9rem; color: #6b4a1f; font-style: italic; min-height: 1px; } /* Callouts */ .news-article [class^="aa-callout-"] { padding: 1rem 1.2rem; margin: 1.5rem 0; border-radius: 6px; border-left: 4px solid; } .news-article .aa-callout-info { background: #eaf2fb; border-color: #2a6bbf; color: #1c3a66; } .news-article .aa-callout-tip { background: #fdf3e0; border-color: #c97a1a; color: #6b3a0a; } .news-article .aa-callout-warning { background: #fbeccb; border-color: #b88012; color: #6b4a0a; } .news-article .aa-callout-success { background: #e1f0e3; border-color: #2f7a3a; color: #1c4a25; } /* Embed placeholder */ .news-article .aa-embed { margin: 1.5rem 0; padding: 1rem; background: #f6efe2; border: 1px dashed #b69968; border-radius: 6px; text-align: center; font-size: 0.85rem; color: #6b4a1f; } .news-article .aa-embed::before { content: "Embed video"; font-weight: 600; }

Kimi K3 arrive demain en open weights. Et Washington menace Moonshot de sanctions.

Une semaine où le plus gros modèle open weight de l’histoire (2 800 milliards de paramètres) devient un incident diplomatique, où Black Forest Labs unifie image, vidéo, audio et robotique dans un seul réseau, et où Google sort trois modèles Flash le même jour. La cadence est le nouveau moat.

Le résumé en 30 secondes
  • Le 22 juillet 2026, Michael Kratsios (Maison-Blanche) accuse Moonshot d’avoir « distillé » Anthropic Fable 5 pour construire Kimi K3, et d’avoir utilisé des serveurs Nvidia GB300 basés en Thaïlande ; le Trésor évoque des sanctions.
  • Les poids ouverts de Kimi K3 (2 800 Md de paramètres, MoE sparse, 1 M de contexte) sortent le 27 juillet, soit demain.
  • Black Forest Labs sort FLUX 3 le 23 juillet : un modèle unique pour image, vidéo (20 secondes avec audio synchronisé natif) et prédiction d’actions robotiques.
  • Google balance Gemini 3.6 Flash, 3.5 Flash-Lite et 3.5 Flash Cyber en une seule annonce le 21 juillet.
  • AMD s’allie à Cerebras pour attaquer le duopole Nvidia+Groq sur l’inférence.
DateActeurOpérationMontant / Détail
16 juillet 2026Moonshot AIRelease Kimi K32 800 Md de paramètres, poids ouverts prévus le 27 juillet
21 juillet 2026Google DeepMindTrio Gemini Flash3.6 Flash, 3.5 Flash-Lite, 3.5 Flash Cyber en une annonce
21 juillet 2026AlibabaQwen-Image-3.0Nouvelle génération image, poids ouverts sous licence Qwen
23 juillet 2026Black Forest LabsFLUX 3 multimodalImage, vidéo (20 s. + audio), robotique. Version Dev open weight fin 2026
23 juillet 2026Ant GroupLing-3.0-flashSparse MoE, inférence temps réel low-cost sur Alibaba Cloud
23 juillet 2026AMD + CerebrasAlliance inférenceWafer scale intégré au portfolio AMD, >2 000 tokens/s
23 juillet 2026NVIDIA + KAISTJoint AI labLaboratoire agentique à Séoul, focus Corée du Sud
Juillet 2026OpenAIRachat Northslope2e acquisition applied-AI, engineers forward-deployed
Juillet 2026SambaNovaSérie F1 Md$ — valo 11 Md$ — lead General Atlantic
Juillet 2026Baseten + Fireworks AILevées parallèles1,5 Md$ chacun sur l’inférence entreprise

Le week-end où Kimi K3 arrive et Washington sort l’artillerie

Moonshot AI a publié Kimi K3 le 16 juillet 2026 : 2 800 milliards de paramètres, architecture LatentMoE (Mixture of Experts sparse, 16 experts actifs sur 896 par token), fenêtre de contexte d’un million de tokens, vision native. C’est numéricalement le plus gros modèle à poids ouverts jamais annoncé. Sur Frontend Code Arena, K3 caracole en tête à 1 679 points, devant Claude Fable 5. Les benchmarks internes le donnent au-dessus de Claude Opus 4.8 max et GPT-5.5 high, en dessous de Fable 5 et GPT-5.6 Sol. Le poids Release arrive demain, 27 juillet.

Six jours après le lancement, le 22 juillet, Michael Kratsios (OSTP) accuse Moonshot d’avoir monté une plateforme interne pour interroger Fable 5 à grande échelle via des accès multiples masqués, et d’utiliser des serveurs Nvidia GB300 basés en Thaïlande — matériel Blackwell interdit à l’export vers la Chine. Le secrétaire au Trésor Scott Bessent enfile la menace de sanctions et de blacklistage export dans la foulée. C’est le premier vrai clash post-AI Act qui mélange propriété intellectuelle, contrôles à l’export et politique industrielle. Le calendrier est inconfortable pour tout le monde : la sortie des poids demain va rendre l’audit indépendant possible — et donc la controverse plus tranchable.

Ce que la distillation reproche à Moonshot — et pourquoi c’est arithmétiquement tendu

La distillation, techniquement, c’est entraîner un modèle élève à imiter les sorties d’un modèle maître plus fort. Fait à petite échelle et publiquement, c’est légal et courant. Fait à l’échelle industrielle avec des accès API multiples camouflés, c’est du vol de modèle sous l’angle des Terms of Service — potentiellement du vol de secrets commerciaux.

Le problème, c’est le calendrier. Anthropic Fable 5 n’a été ouvert au grand public que le 1er juillet 2026 (après une suspension liée aux contrôles d’export en juin). Kimi K3 est sorti 15 jours plus tard. Pour distiller un modèle frontier dans un MoE de 2 800 Md de paramètres, il faut typiquement plusieurs mois de génération de données synthétiques, de pré-entraînement, de mise au point RLHF. Trois semaines, même avec un cluster monstrueux, c’est court. Deux hypothèses tiennent debout : soit Moonshot avait un accès pré-public à Fable (test/partenariat), soit la distillation cible en réalité Opus 4.8 et GPT-5.5, disponibles depuis bien plus longtemps. Kratsios n’a pas montré les preuves, seulement l’accusation. À suivre.

FLUX 3 : le multimodal unifié devient la norme

Black Forest Labs a lancé FLUX 3 le 23 juillet 2026 Multimodal. Le pitch est simple : un seul modèle, une seule architecture, entraînée sur images, vidéos et audios ensemble. En sortie : image (avec rendu texte lisible et multilingue), vidéo texte-vers-vidéo jusqu’à 20 secondes avec audio synchronisé natif, édition d’image, et — c’est la vraie surprise — prédiction d’actions robotiques via un module baptisé FLUX-mimic.

C’est la fin du schéma où on empile un modèle image, un modèle TTS, un modèle vidéo, puis on colle tout à la main. FLUX 3 apprend les corrélations entre modalités pendant l’entraînement : le son colle à l’impact, le mouvement respecte la physique, la scène reste cohérente. Le déploiement est phasé : FLUX 3 Video est en early access API et poids privés pour partenaires, FLUX 3 Action réservé à quelques labos robotiques, FLUX 3 Image sort dans les prochaines semaines, et une version FLUX 3 Dev en open weight est promise pour fin 2026. Le positionnement attaque frontalement Sora 3 (OpenAI) et Veo 4 (Google), avec un argument différenciant : l’audio natif dans le même réseau, pas en post-processing.

Google, OpenAI, Alibaba : la cadence est le nouveau moat

Google DeepMind a annoncé trois modèles le 21 juillet en une seule communication : Gemini 3.6 Flash (généraliste rapide), Gemini 3.5 Flash-Lite (encore moins cher, pour l’inférence de masse), et Gemini 3.5 Flash Cyber (spécialisé sécurité offensive et défensive). La lecture est transparente : couvrir chaque point de prix contre GPT-5.6 Luna/Terra/Sol (respectivement 1 $, 2,5 $ et 5 $ le million de tokens input) et écraser Mistral et DeepSeek sur l’inférence bon marché.

OpenAI, en parallèle, a lancé une plateforme d’agents entreprise et annoncé un nouveau data center dont l’investissement dépasserait 30 Md$. Le groupe a aussi racheté Northslope, sa 2e acquisition « applied AI » de l’année, pour renforcer ses équipes d’ingénieurs forward-deployed qui vont construire les systèmes chez le client. Alibaba, de son côté, publie du Qwen chaque semaine : Qwen-Audio-3.0-TTS Flash et Plus le 20 juillet, Qwen-Image-3.0 le 21 juillet. La cadence hebdo devient un signal en soi : elle témoigne de la maturité du pipeline de release, du batching des expériences, et de la capacité à encaisser des bugs post-launch sans casser la réputation. Un labo qui n’arrive plus à sortir mensuellement dit quelque chose sur sa structure interne.

AMD + Cerebras contre Nvidia + Groq : le duopole inférence est cassé

Le 23 juillet 2026, Lisa Su a annoncé sur scène au Advancing AI un partenariat AMD-Cerebras Alliance. Cerebras intègre son wafer scale engine dans le portfolio AMD, ce qui bouche le trou laissé par le rachat de Groq par Nvidia pour 20 Md$ en décembre 2025. Cerebras revendique des sorties de plus de 2 000 tokens par seconde en inférence, grâce à sa SRAM on-chip qui évite le va-et-vient mémoire des GPU classiques.

Pour un CTO qui choisit son fournisseur d’inférence en 2026, la carte se redessine. Nvidia domine l’entraînement (Vera Rubin, GB300) et pousse Groq 3 sur l’inférence via des racks LPX. En face, AMD+Cerebras propose une alternative unique sur la latence extrême, avec un discours « pas de vendor lock-in NVLink ». Baseten et Fireworks AI, qui viennent de lever 1,5 Md$ chacun sur cette thématique, sont les grands bénéficiaires indirects : plus il y a d’options de silicium, plus leur rôle d’abstraction devient précieux. Together AI ferme la boucle avec ses 800 M$ post-valo à 8,3 Md$, sur le créneau « infer sur open source, quel que soit le hardware ». Le marché de l’inférence n’est plus une chasse gardée.

Ce que ça change pour vous cette semaine

Trois angles concrets. D’abord, si vous construisez avec des modèles open weight, mettez en garde vos utilisateurs européens : depuis le 10 juillet, la disclosure chatbot est enforceable en UE, et le 2 août 2026 marque l’application du reste des dispositions AI Act. Les amendes peuvent monter à 20 M€ ou 4 % du CA mondial pour un mauvais traitement des données personnelles.

Ensuite, si vous n’avez pas encore testé un modèle chinois open source dans votre stack (Qwen, DeepSeek, Kimi, GLM, MiniMax), la semaine du 27 juillet est un bon moment : les poids K3 vont être expérimentés partout, les retours seront rapides. Ne fondez pas votre production dessus sans due diligence légale sur la controverse en cours. Enfin, si vous facturez de l’inférence en refacturation, redécoupez votre offre : les prix Google/OpenAI/Groq bougent chaque semaine, votre marge se ferme silencieusement si vous ne rebattez pas les cartes chaque mois.

Testez votre lecture de la semaine

Combien de paramètres compte Kimi K3 — et quelle est son architecture ?

Quelle est la principale accusation de la Maison-Blanche contre Moonshot le 22 juillet 2026 ?

Quelle nouveauté techniquement significative FLUX 3 apporte-t-il ?

Combien de modèles Google a-t-il annoncé le 21 juillet 2026 dans une seule communication ?

Quel partenariat annoncé le 23 juillet 2026 vise directement le duopole Nvidia+Groq sur l’inférence ?

À retenir pour la semaine prochaine : le 27 juillet, la sortie des poids de Kimi K3 va permettre un audit indépendant — c’est le premier signal fiable sur la controverse distillation. Le 2 août, l’AI Act européen franchit une nouvelle marche. Ces deux dates conditionnent la réaction des CTO européens qui évaluaient Kimi K3 pour leur production.

← Toutes les actualités IA · Nos formations IA