Cinq faux départs, un modèle : la semaine où Grok a rattrapé son retard sur l'IA frontière
xAI a lancé Grok 4.7 le 21 septembre 2026, un modèle de 2 100 milliards de paramètres, après avoir repoussé son annonce cinq fois depuis fin juillet. La même semaine, OpenAI a proposé le 22 septembre une coordination internationale des régulateurs de l'IA, pendant que CoreWeave affichait un carnet de commandes de 104,2 milliards de dollars adossé à 35 milliards de dollars de dette.
- xAI a lancé Grok 4.7 le 21 septembre 2026, avec 2 100 milliards de paramètres et un prix inchangé de 2 dollars par million de tokens en entrée.
- OpenAI a proposé le 22 septembre 2026 une coordination avec les régulateurs de l'IA des Etats-Unis, de l'Union européenne, de la France, du Canada, du Royaume-Uni, du Japon et de la Corée du Sud.
- CoreWeave portait au deuxième trimestre 2026 un carnet de commandes de 104,2 milliards de dollars contre 35 milliards de dollars de dette totale.
- AMD et NVIDIA ont obtenu mi-septembre 2026 un accord autorisant la vente de puces IA en Chine contre un reversement de 15% au Trésor américain.
- Ollama a publié la version 0.34.1 le 19 septembre 2026 avec le support du modèle ouvert Qwen3.8 27B d'Alibaba.
Pourquoi Grok 4.7 de xAI arrive-t-il si tard, et avec quoi ?
xAI a lancé Grok 4.7 le 21 septembre 2026, après avoir repoussé l'annonce au moins cinq fois depuis fin juillet. Elon Musk avait successivement promis "quatre semaines", puis "quelques semaines", puis "3 à 4 semaines", puis "10 jours" le 1er septembre, puis "encore quelques jours" le 11 septembre. Le modèle final embarque 2 100 milliards de paramètres, soit 40% de plus que les 1 500 milliards de Grok 4.6, pour un prix identique de 2 dollars par million de tokens en entrée et 6 dollars en sortie. xAI met en avant un entraînement par renforcement plus long et un nouvel empilement de garde-fous, avec un taux de passage de 3,3% sur son test interne de prompts à risque HackerBench v0.3. Sur le plan des performances, Grok 4.7 obtient 46,3% sur CursorBench 4.0 contre 40,4% pour son prédécesseur, et 71,0% sur DeepSWE v1.1 en mode haut effort. Le modèle est disponible immédiatement dans Cursor, Grok Build, l'API xAI et plusieurs harnais de code tiers, ce qui en fait avant tout un outil pensé pour les développeurs plutôt qu'un modèle généraliste grand public.
Pourquoi OpenAI propose-t-il une coordination internationale des régulateurs de l'IA ?
OpenAI a suggéré le 22 septembre 2026 au gouvernement américain de coordonner les régulateurs nationaux de l'IA de sept juridictions, dont les Etats-Unis, l'Union européenne, la France, le Canada, le Royaume-Uni, le Japon et la Corée du Sud, pour aboutir à des standards communs d'évaluation des risques. La proposition intervient dans un contexte judiciaire tendu : quatre consommateurs ont attaqué Anthropic, OpenAI, Google DeepMind et xAI le 18 septembre pour collusion antitrust autour du pacte volontaire "Pace the Frontier", annoncé le 12 septembre pour ralentir la cadence de sortie des modèles frontière. En proposant elle-même un cadre de coordination réglementaire, OpenAI cherche à déplacer le débat du terrain judiciaire vers celui de la gouvernance négociée, une stratégie qui rappelle les discussions entre labos sur un organisme commun de normes évoquées depuis juillet. Le calendrier n'est pas anodin : la proposition arrive une semaine seulement après l'ouverture de la plainte antitrust, ce qui en fait autant un geste de bonne volonté qu'un argument de défense.
Pourquoi le carnet de commandes de CoreWeave inquiète-t-il malgré son record ?
CoreWeave portait au deuxième trimestre 2026 un carnet de commandes de 104,2 milliards de dollars, un chiffre supérieur à sa capitalisation boursière, mais adossé à une dette totale de 35 milliards de dollars contre 22,7 milliards trois mois plus tôt. Les intérêts trimestriels ont atteint 640 millions de dollars, plus du double des 267 millions versés un an auparavant. La capacité data center du fournisseur cloud spécialisé en IA est passée de 70 mégawatts à 1,5 gigawatt en un an et demi, avec un objectif de 1,85 gigawatt de puissance active d'ici fin 2026 et un capex annuel annoncé entre 35 et 39 milliards de dollars. Ce grand écart entre demande contractée et endettement illustre une tension structurelle du secteur des neoclouds : les contrats pluriannuels de type "take-or-pay" garantissent des revenus futurs, mais la construction physique des data centers se finance aujourd'hui à crédit, dans un contexte où le goulot d'étranglement de l'IA s'est déplacé de la puce vers l'électricité, comme le montrait déjà le backlog de 664 milliards de dollars d'Oracle publié le 9 septembre.
Pourquoi Washington a-t-il autorisé AMD et NVIDIA à vendre des puces IA en Chine ?
AMD et NVIDIA ont obtenu, la semaine du 15 septembre 2026, un accord de l'administration américaine autorisant la vente d'une gamme de puces IA moins puissantes sur le marché chinois, en échange d'un reversement de 15% des ventes au Trésor américain, pour plus de 2 milliards de dollars de recettes attendues côté gouvernement. Cet arrangement s'inscrit dans un climat de méfiance réciproque : les agences américaines NSA, CISA et FBI ont accusé début septembre six laboratoires chinois de distillation systématique de modèles américains, tandis que Pékin annonçait en parallèle un plan d'infrastructure de calcul souverain de 532 milliards de dollars d'ici 2030. Autoriser des ventes limitées plutôt que de maintenir un embargo total permet à Washington de conserver une source de revenus et une forme d'influence commerciale sur l'écosystème chinois, tout en évitant que la demande locale ne se reporte entièrement vers des accélérateurs domestiques comme ceux déjà déployés par Z.AI sur plus de 100 000 puces chinoises.
Pourquoi le marché français de l'IA reste-t-il actif après la levée record de Mistral ?
L'écosystème French Tech a annoncé 42,2 millions d'euros de levées cumulées entre le 14 et le 18 septembre 2026, dont 34,5 millions d'euros pour six startups utilisant l'IA, soit 82% des montants de la semaine. Ce retour à des tickets plus resserrés fait suite au tour de table de 3 milliards d'euros bouclé par Mistral AI le 8 septembre, qui avait porté sa valorisation au-dessus de 21 milliards d'euros et constituait le plus gros financement jamais réalisé par une tech européenne. TypeSafe AI a de son côté levé 40 millions de dollars en amorçage le 16 septembre pour un modèle d'IA composable, signe que l'investissement en phase précoce continue malgré la concentration des très gros tickets autour d'un nombre restreint d'acteurs. Cette dynamique à deux vitesses, un mégadeal suivi d'une multitude de tours plus modestes, est cohérente avec la structure du financement IA observée ailleurs en Europe depuis le début de l'année.
Comment les outils d'IA locale progressent-ils cette semaine ?
Ollama a publié la version 0.34.1 le 19 septembre 2026, avec le support du modèle ouvert Qwen3.8 27B d'Alibaba et un cache de métadonnées de modèles qui réduit de moitié le temps jusqu'au premier token. Le projet dépasse désormais 162 000 étoiles sur GitHub et maintient une cadence de publication hebdomadaire. LM Studio a suivi avec la version 0.4.24, une mise à jour mensuelle qui prolonge le lancement en juillet de LM Studio Bionic, une application d'agents pour exécuter des modèles ouverts directement sur un ordinateur personnel. Qwen3.8-Max-0902, la variante ouverte à un million de tokens de contexte d'Alibaba, tarifée 2 dollars par million de tokens en entrée et 6 dollars en sortie, offre par ailleurs un point de comparaison prix direct avec Grok 4.7 pour les équipes qui arbitrent entre modèle propriétaire et poids ouverts. Cette semaine confirme une tendance de fond : l'écart de performance entre les runtimes locaux et les API propriétaires continue de se resserrer, même si Ollama et LM Studio répondent à des usages différents, l'un scriptable et orienté serveur, l'autre pensé pour une expérience "point-and-click" sur poste de travail.
Testez votre lecture de la semaine
Combien de fois Elon Musk a-t-il repoussé la sortie de Grok 4.7 avant son lancement le 21 septembre 2026 ?
Quel est le prix par million de tokens en sortie facturé pour Grok 4.7 ?
Quel laboratoire a proposé le 22 septembre 2026 une coordination internationale des régulateurs de l'IA ?
Quel était le carnet de commandes de CoreWeave après le deuxième trimestre 2026 ?
Quel pourcentage des ventes de puces IA en Chine les Etats-Unis prélèvent-ils dans l'accord conclu avec AMD et NVIDIA ?