Kimi K3, Bruxelles, GPT-5.6 : la semaine où l’IA a changé de règles
Un modèle open-weight chinois à 2,8 trillions de paramètres tarifé au niveau de Sonnet, un régulateur européen qui force Android à ouvrir la porte aux agents rivaux, et OpenAI qui bascule GPT-5.6 en trois tiers. La semaine du 12 au 18 juillet 2026 acte plusieurs bascules structurelles pour qui construit avec l’IA.
- Moonshot AI publie Kimi K3, 2,8 T de paramètres MoE, #1 sur Frontend Code Arena, tarifé $3/$15 par million de tokens.
- La Commission européenne impose à Google d’ouvrir 11 fonctions Android aux agents IA concurrents d’ici août 2027.
- OpenAI passe GPT-5.6 en disponibilité générale en trois tiers Sol/Terra/Luna et lance ChatGPT Work.
- Together AI lève 800 M$ en Series C à 8,3 Md$ de valorisation, plus gros deal infra IA du mois.
- NVIDIA absorbe les LPU Groq 3 dans CUDA et vise 35× le débit inference par mégawatt.
Kimi K3, la Chine ne fait plus du discount
Le 16 juillet 2026, Moonshot AI publie Kimi K3, un modèle Mixture-of-Experts de 2,8 trillions de paramètres — le plus gros open-weight jamais annoncé, les poids ouverts étant promis d’ici le 27 juillet. Le modèle est multimodal natif, avec un contexte de 1 million de tokens et un nouveau mécanisme Kimi Delta Attention. Sur GDPval-AA v2, benchmark de tâches réelles couvrant 44 métiers et 9 industries, K3 termine 3e avec 1 687 points, derrière Claude Fable 5 Max (1 815) et GPT-5.6 Sol Max (1 747,8) mais devant Opus 4.8 (1 600). Sur Frontier Code Arena, il gagne 17 places d’un coup et passe #1 sur six domaines frontend sur sept. Sur GPQA Diamond, il pose 93,5%, meilleur score open-weight publié à date.
Ce qui compte : le pricing. $3/$15 par million de tokens en entrée/sortie, c’est aligné sur Sonnet 5 hors promo et c’est le tarif le plus élevé jamais publié par un labo chinois. Le narratif « modèle chinois = low-cost par défaut » vient de se fissurer. Moonshot assume un positionnement premium, cohérent avec des chiffres de bench qui ne laissent plus beaucoup de place à un rabais tactique.
Bruxelles ouvre Android aux agents rivaux
Le même 16 juillet, la Commission européenne publie deux jeux de mesures contraignantes sous le Digital Markets Act (DMA). Google devra rendre 11 fonctions système d’Android accessibles aux agents IA concurrents dans les mêmes conditions que Gemini : activation vocale par mot-clé, tâches d’arrière-plan comme la réservation de restaurant via une app tierce, gestion des notifications. L’échéance principale est fixée à août 2027, la détection hotword concurrente étant embarquée dès Android 19.
Second volet : Google devra partager, d’ici janvier 2027, une portion anonymisée de ses données de recherche avec des moteurs concurrents. Kent Walker, président des affaires globales de Google, a immédiatement contesté en agitant le risque privacy — argument classique dans ce type de bras de fer. Concrètement, c’est la première brèche sérieuse dans le monopole de distribution mobile pour tout ce qui ressemble à un agent, et Perplexity, Anthropic, Mistral ou ChatGPT sont les gagnants directs.
GPT-5.6 en GA : OpenAI copie enfin la structure tarifaire d’Anthropic
Depuis le 9 juillet 2026, GPT-5.6 est en disponibilité générale sur trois tiers : Sol, flagship avec sous-agent Ultra et niveau de raisonnement Max ; Terra, qualité GPT-5.5 pour moitié prix ; Luna, tier rapide. Tous tournent sur la pretrain Spud à 4 T de paramètres. Sol est le premier modèle à battre un jeu public sur ARC-AGI-3 avec 7,8%. Le même jour, OpenAI lance ChatGPT Work, un agent qui parcourt les apps et fichiers connectés et rend documents, tableurs, présentations et rapports finalisés. Positionné frontalement face à Claude Cowork et Gemini Enterprise, il complète le pivot vers l’agent qui livre du travail structuré.
La release contient aussi un détail matériel qui a fait rire l’écosystème dev : un clavier physique 13 switchs à 230 $ dédié à Codex. Gimmick ou pas, il documente une chose sérieuse — OpenAI veut du mindshare sur le poste de travail développeur, terrain où Anthropic et Cursor mènent depuis 18 mois.
Meta, xAI, Anthropic : la course aux agents s’intensifie
Mark Zuckerberg a annoncé Muse Spark 1.1, agent 1 M de contexte qui revendique le #1 sur MCP Atlas, JobBench, Humanity’s Last Exam et Finance Agent V2. Meta abandonne officiellement l’idée de rattraper ChatGPT côté chatbot grand public et concentre ses tirs sur l’infra agentique B2B. En parallèle, xAI a sorti Grok 4.5 le 8 juillet, orienté coding. Anthropic a restauré Claude Fable 5 globalement le 1er juillet après la levée des contrôles export américains, et maintient Sonnet 5 « Fennec » à $2/$10 promo jusqu’au 31 août — un tarif d’acquisition agressif qui met la pression sur le Terra d’OpenAI.
Côté open source, l’écosystème s’étoffe autour de GLM-5.2 (meilleur tout-terrain selon les leaderboards), Qwen 3 235B-A22B (raisonnement + coding), DeepSeek V4 (math) et Kimi K2.7 Code (agents coding data-centre). Ollama, LM Studio, vLLM et MLX intègrent tous Kimi K3 en preview API en attendant les poids ouverts.
NVIDIA verrouille l’inference avant que Cerebras et AMD ne respirent
À GTC 2026, NVIDIA a annoncé l’intégration des LPU Groq 3 dans son écosystème CUDA. Le nouveau rack Groq 3 LPX embarque 128 LPUs : couplé au rack Vera Rubin NVL72, NVIDIA promet 35× le débit inference par mégawatt et 10× l’opportunité de revenu par déploiement. La logique : les GPU HBM traitent le prefill du prompt, les LPU se chargent du decode. C’est une consolidation qui neutralise un vecteur d’attaque plutôt qu’une extension de gamme.
AMD, elle, étend ses partenariats avec OpenAI et Oracle sur les MI300, et une thèse d’analyste chez The Motley Fool positionne AMD comme le plus gros gagnant potentiel de la vague inference. Cerebras continue de miser sur son SRAM on-chip pour la vitesse. NVIDIA garde 70 à 80% de part de marché sur l’IA — le vrai enjeu de la semaine, c’est de savoir si le deal Groq consolide cette position ou signale qu’elle commence à devenir défendable au prix fort.
Le mois où le VC a acté l’IA comme actif dominant
Crunchbase a publié le 17 juillet 2026 les chiffres H1 2026 : 510 Md$ investis en capital-risque mondial, record absolu pour un semestre, dont la majorité fléchée IA. Semaine du 14 au 18 juillet, les levées les plus significatives sont Together AI (800 M$ à 8,3 Md$), Chai Discovery (400 M$), AIsphere (439 M$ lead Alibaba pour la vidéo IA), Harvey (200 M$ à 2,1 Md$ pour le legal), Lovable (200 M$ à 2,8 Md$ pour le vibe coding), Glean (180 M$ à 2,7 Md$ sur la recherche entreprise), Hebbia (130 M$ à 1 Md$). Helsing consolide sa levée de 1,8 Md$ dans la défense.
La composition est parlante : infra + coding + verticaux métier + défense. Zéro chatbot généraliste dans le top de la semaine. Le marché a acté que la marge se fait sur des applications avec workflow métier réel, pas sur un énième front-end de modèle.
Testez votre lecture de la semaine
Combien de paramètres compte Kimi K3 ?
Combien de fonctions Android le DMA impose-t-il à Google d’ouvrir aux agents rivaux ?
Quels sont les trois tiers de GPT-5.6 ?
Quelle levée a été la plus grosse cette semaine dans l’infra IA ?
Quel gain de débit inference par mégawatt NVIDIA revendique-t-il avec Groq 3 LPX + Vera Rubin ?