428 milliards de paramètres, zéro poids saoudien : la semaine où la souveraineté IA a changé de camp
Le 3 septembre 2026, Humain, la société d'IA du fonds souverain saoudien PIF, a présenté humain-m3, un modèle arabe présenté comme la pierre angulaire de sa stratégie d'IA nationale. Problème : ce modèle "souverain" repose entièrement sur les poids ouverts du chinois MiniMax. Pendant ce temps, l'infrastructure cloud devient un actif financier à part entière et les IDE occidentaux avalent sans complexe les poids ouverts venus d'ailleurs.
- Humain (Arabie saoudite) lance humain-m3, modèle arabe de 428 milliards de paramètres, entraîné sur les poids ouverts chinois de MiniMax et plus de 1 000 milliards de tokens arabes.
- Crusoe lève plus de 3 milliards de dollars à une valorisation de 30 milliards, portée par un contrat cloud de 13 milliards avec Jane Street.
- Qwen (Alibaba) publie Qwen3.8 27B en poids ouverts ; GitHub Copilot ajoute de son côté Kimi K2.7 Code (Moonshot) à son catalogue.
- xAI lance Grok Bot et Grok 4.5 pour l'entreprise, avec une intégration profonde dans Cursor.
- AMD et Cerebras avancent une architecture d'inférence désagrégée pour concurrencer NVIDIA et Groq.
Une souveraineté bâtie sur des fondations importées
Humain, filiale du fonds souverain saoudien PIF fondée en mai 2025 sous l'impulsion du prince héritier Mohammed ben Salmane, a dévoilé le 3 septembre 2026 humain-m3, présenté comme le socle de l'infrastructure IA nationale du royaume. Produit Le modèle utilise une architecture Mixture-of-Experts d'environ 428 milliards de paramètres au total, avec 23 milliards de paramètres actifs par token. Sur le papier, la performance est réelle : une moyenne de 89,37% sur sept benchmarks arabes, un score qui place humain-m3 parmi les meilleurs modèles disponibles pour cette langue. Mais la méthode interroge : Humain n'a pas entraîné son modèle from scratch, il a repris les poids ouverts M3 du chinois MiniMax et les a affinés sur plus de 1 000 milliards de tokens arabes. Les poids finaux doivent être publiés en open source et déployés sur l'infrastructure souveraine saoudienne. La question posée par cette annonce dépasse l'Arabie saoudite : à mesure que de plus en plus de pays cherchent une indépendance IA, combien vont simplement louer la souveraineté de quelqu'un d'autre plutôt que de la construire ?
L'infrastructure cloud devient un actif financier comme un autre
Le 3 septembre 2026, Crusoe a annoncé une levée de plus de 3 milliards de dollars qui valorise l'entreprise à environ 30 milliards de dollars, un tour co-mené par Atreides Management et Valor Equity Partners, avec la participation de Mubadala Capital, le fonds souverain d'Abou Dabi. Levée C'est trois fois la valorisation obtenue lors du Series E d'octobre 2025 (plus de 10 milliards de dollars). Le déclencheur direct : un contrat cloud de 13 milliards de dollars sur cinq ans avec la société de trading quantitatif Jane Street, pour fournir des GPU et de l'infrastructure IA. Crusoe travaille aussi avec OpenAI, Microsoft et Meta sur la construction de data centers. Ce type de deal illustre un glissement : l'infrastructure de calcul n'est plus seulement un poste de dépense pour les labs, c'est devenu une classe d'actifs que des fonds souverains et des gestionnaires financiers achètent directement.
Le code s'ouvre aux poids venus d'ailleurs
Pendant que les géants américains occupent l'attention, l'open source continue d'avancer méthodiquement. Qwen, la division IA d'Alibaba, a publié le 2 septembre 2026 Qwen3.8 27B, une déclinaison plus légère de sa gamme après la version cloud Qwen3.8-Max sortie début août. Produit Au même moment, GitHub Copilot a ajouté Kimi K2.7 Code, le modèle de code du chinois Moonshot AI, à son catalogue de modèles disponibles pour les développeurs. Ce n'est pas un détail : un outil aussi installé que Copilot, utilisé par des millions de développeurs dans des entreprises occidentales, propose désormais nativement un modèle open source chinois à côté de GPT et de Claude. Mistral, de son côté, a fait passer son OCR 4.1 en disponibilité générale et a lancé Agentic Search, une couche de récupération documentaire annoncée comme plus précise et moins coûteuse en tokens que les approches précédentes.
Les agents d'entreprise version xAI
xAI a lancé début septembre 2026 Grok Bot, une expérience d'agents persistants organisée autour de "bots" nommés, avec présence, mémoire de contexte, widgets intégrés et routines qui démarrent du travail sans qu'on ait besoin de lancer un prompt. Produit En parallèle, Grok 4.5, le modèle de code de xAI, a été entraîné sur du comportement réel de développeurs à l'intérieur de Cursor, et vise en priorité le débogage, le refactoring et les sessions de code multi-fichiers longues. xAI offre deux semaines d'accès gratuit aux clients Grok Enterprise et Cursor Enterprise, un geste commercial classique pour installer l'habitude avant la facturation. La bataille des agents d'entreprise autonomes s'ajoute donc à celle des assistants de code, avec un acteur de plus dans la course face à OpenAI, Anthropic et Google DeepMind.
Une nouvelle ligne de front matérielle face à NVIDIA
Le 23 juillet 2026, AMD et Cerebras Systems ont dévoilé lors de l'événement Advancing AI d'AMD à San Francisco une architecture d'inférence désagrégée qui associe les racks Helios d'AMD au Wafer-Scale Engine de Cerebras. Partenariat Le principe : AMD Helios traite les prompts initiaux et les longs contextes à haut débit, pendant que la puce Cerebras prend en charge la génération de tokens, une étape gourmande en bande passante mémoire, avec une latence très faible. Cerebras prévoit de déployer les systèmes Helios d'AMD dans ses propres data centers, avec une disponibilité via Cerebras Cloud prévue pour le second semestre 2026. Ce duo se positionne frontalement contre l'ensemble NVIDIA NVL72 et Groq LPU — NVIDIA ayant d'ailleurs racheté des actifs de Groq en décembre pour 20 milliards de dollars afin d'intégrer sa technologie faible latence. La bataille de l'inférence ne se joue donc plus seulement sur les modèles, mais sur qui contrôle le silicium qui les fait tourner.
Testez votre lecture de la semaine
Combien de milliards de paramètres compte humain-m3 ?
Quelle entreprise a fourni les poids ouverts utilisés par Humain pour construire humain-m3 ?
À combien s'élève la valorisation de Crusoe après sa levée du 3 septembre 2026 ?
Quel modèle de code xAI a été entraîné sur du comportement réel de développeurs dans Cursor ?
Quel duo de fabricants de puces s'allie pour concurrencer NVIDIA et Groq sur l'inférence à faible latence ?