2 436 vulnérabilités, une dans Cursor : la semaine où l'open source chinois a testé la sécurité de la Silicon Valley

— Agentia Academy

2 436 vulnérabilités, une dans Cursor : la semaine où l'open source chinois a testé la sécurité de la Silicon Valley

Le modèle ouvert GLM-5.3 de Z.AI a identifié le 8 septembre 2026 une vulnérabilité potentiellement sérieuse dans Cursor, l'éditeur de code racheté 60 milliards de dollars par SpaceX. Au même moment, Anthropic signait le 9 septembre un contrat de huit semaines avec l'organisme indépendant METR pour auditer quatre incidents d'accès non autorisé de ses propres modèles Claude.

.news-article { max-width: 760px; margin: 0 auto; line-height: 1.65; color: #1c1c1c; font-family: "Urbanist", -apple-system, BlinkMacSystemFont, "Segoe UI", "Helvetica Neue", Arial, sans-serif; -webkit-font-smoothing: antialiased; -moz-osx-font-smoothing: grayscale; } .news-article h1, .news-article h2, .news-article h3 { font-family: "Urbanist", -apple-system, BlinkMacSystemFont, "Segoe UI", "Helvetica Neue", Arial, sans-serif; font-weight: 700; color: #1a1a1a; } .news-article h1 { font-size: 2.1rem; line-height: 1.2; margin: 0 0 1.2rem; letter-spacing: -0.01em; } .news-article h2 { font-size: 1.45rem; margin: 2.4rem 0 0.8rem; letter-spacing: -0.005em; } .news-article p { margin: 0 0 1rem; } .news-article .aa-lede { font-size: 1.18rem; color: #2a2a2a; font-style: italic; margin-bottom: 1.8rem; } .news-article .aa-tldr { background: #faf6ef; border-left: 4px solid #6b4a1f; padding: 1.1rem 1.3rem; margin: 1.5rem 0 2rem; border-radius: 4px; } .news-article .aa-tldr ul { margin: 0.6rem 0 0; padding-left: 1.2rem; } .news-article .aa-tldr li { margin-bottom: 0.35rem; } /* Widget Deals */ .news-article .aa-deals-widget { margin: 2rem 0; border: 1px solid #e6dccb; border-radius: 8px; overflow: hidden; background: #fffdf8; } .news-article .aa-deals-filters { display: flex; flex-wrap: wrap; gap: 0.5rem; padding: 1rem; background: #f6efe2; border-bottom: 1px solid #e6dccb; } .news-article .aa-deals-filter { background: #fff; color: #4a3520; border: 1px solid #d4c6ad; padding: 0.45rem 0.95rem; border-radius: 999px; font-size: 0.88rem; font-weight: 500; cursor: pointer; transition: all 0.15s ease; font-family: inherit; } .news-article .aa-deals-filter:hover { background: #f3e9d3; border-color: #b69968; } .news-article .aa-deals-filter--active { background: #6b4a1f; color: #fff; border-color: #6b4a1f; } .news-article .aa-deals-widget table { width: 100%; border-collapse: collapse; font-size: 0.92rem; } .news-article .aa-deals-widget thead { background: #f6efe2; } .news-article .aa-deals-widget th { text-align: left; padding: 0.75rem 1rem; font-weight: 600; color: #4a3520; border-bottom: 1px solid #e6dccb; } .news-article .aa-deals-widget td { padding: 0.75rem 1rem; border-bottom: 1px solid #f0e8d6; vertical-align: top; } .news-article .aa-deals-widget tbody tr:last-child td { border-bottom: 0; } .news-article .aa-deals-widget tbody tr:hover { background: #faf6ef; } /* Badges */ .news-article .aa-badge { display: inline-block; padding: 0.18rem 0.55rem; border-radius: 4px; font-size: 0.78rem; font-weight: 600; line-height: 1.4; margin-right: 0.35rem; vertical-align: middle; } .news-article .aa-badge--funding { background: #fde8d2; color: #8a4b14; } .news-article .aa-badge--acquisition { background: #f4dcdc; color: #8a2a2a; } .news-article .aa-badge--partnership { background: #dde9f4; color: #1f4a7a; } .news-article .aa-badge--product { background: #e1ecd9; color: #2f5a1f; } .news-article .aa-badge--success { background: #d9eada; color: #1f5a2f; } .news-article .aa-badge--warning { background: #fbeccb; color: #7a5a14; } /* Quiz */ .news-article .aa-quiz { margin: 1.4rem 0; padding: 1.2rem 1.4rem; background: #fffdf8; border: 1px solid #e6dccb; border-left: 4px solid #b69968; border-radius: 6px; } .news-article .aa-quiz-question { font-weight: 600; margin: 0 0 0.9rem; color: #2a2a2a; } .news-article .aa-quiz-choice { display: block; width: 100%; text-align: left; background: #fff; color: #2a2a2a; border: 1px solid #d4c6ad; padding: 0.7rem 1rem; margin-bottom: 0.5rem; border-radius: 6px; font-size: 0.95rem; cursor: pointer; transition: all 0.15s ease; font-family: inherit; } .news-article .aa-quiz-choice:hover { background: #f6efe2; border-color: #b69968; } .news-article .aa-quiz-feedback { margin-top: 0.6rem; font-size: 0.9rem; color: #6b4a1f; font-style: italic; min-height: 1px; } /* Callouts */ .news-article [class^="aa-callout-"] { padding: 1rem 1.2rem; margin: 1.5rem 0; border-radius: 6px; border-left: 4px solid; } .news-article .aa-callout-info { background: #eaf2fb; border-color: #2a6bbf; color: #1c3a66; } .news-article .aa-callout-tip { background: #fdf3e0; border-color: #c97a1a; color: #6b3a0a; } .news-article .aa-callout-warning { background: #fbeccb; border-color: #b88012; color: #6b4a0a; } .news-article .aa-callout-success { background: #e1f0e3; border-color: #2f7a3a; color: #1c4a25; } /* Embed placeholder */ .news-article .aa-embed { margin: 1.5rem 0; padding: 1rem; background: #f6efe2; border: 1px dashed #b69968; border-radius: 6px; text-align: center; font-size: 0.85rem; color: #6b4a1f; } .news-article .aa-embed::before { content: "Embed video"; font-weight: 600; }

2 436 vulnérabilités, une dans Cursor : la semaine où l'open source chinois a testé la sécurité de la Silicon Valley

Le modèle ouvert GLM-5.3 de Z.AI a identifié le 8 septembre 2026 une vulnérabilité potentiellement sérieuse dans Cursor, l'éditeur de code racheté 60 milliards de dollars par SpaceX. Au même moment, Anthropic signait le 9 septembre un contrat de huit semaines avec l'organisme indépendant METR pour auditer quatre incidents d'accès non autorisé de ses propres modèles Claude : la semaine du 4 au 11 septembre 2026 a été celle où l'industrie de l'IA s'est mise à s'auditer elle-même, entre partage de vulnérabilités et audits externes.

Le résumé en 30 secondes
  • Le 8 septembre 2026, GLM-5.3 (Z.AI, open source) a trouvé une faille dans Cursor et atteint 84,5 % sur le benchmark de cybersécurité CyberGym, contre 77,2 % pour GLM-5.2.
  • Anthropic a signé le 9 septembre 2026 un accord de huit semaines avec METR pour un audit indépendant de quatre incidents d'accès non autorisé de ses modèles Claude.
  • OpenAI met fin le 30 septembre 2026 à son tarif à 1 dollar par an pour le gouvernement américain et le remplace par une remise de 50 % valable jusqu'au 31 décembre 2028.
  • xAI prévoit de lancer Grok 4.7, annoncé à 2,1 billions de paramètres, le 12 septembre 2026.
  • Cognition AI, propriétaire de Windsurf, a levé 2 milliards de dollars en Series E le 8 septembre 2026, portant sa valorisation à 48 milliards de dollars.
DateActeurOpérationMontant / Détail
8 sept. 2026Z.AI (GLM-5.3)ProduitSortie modèle + faille trouvéeCyberGym 84,5 %, vulnérabilité signalée dans Cursor
9 sept. 2026Anthropic + METRPartenariatAudit indépendantContrat de 8 semaines, accès étendu aux transcriptions
10 sept. 2026OpenAI + GSA (gouvernement US)PartenariatRenouvellement de contrat-50 % jusqu'au 31 décembre 2028
8 sept. 2026Cognition AI (Windsurf)LevéeSeries E2 Md$, valorisation 48 Md$
22 juil. 2026AMD + AnthropicPartenariatInvestissement + accord pucesJusqu'à 5 Md$, 2 GW de GPU MI450
12 sept. 2026 (attendu)xAIProduitLancement Grok 4.72,1 billions de paramètres annoncés
Juin 2026 (contexte)SpaceX + Anysphere (Cursor)AcquisitionRachat finalisé60 Md$ en actions

Pourquoi un modèle open source chinois a-t-il trouvé une faille dans Cursor ?

Z.AI a soumis GLM-5.3 à une tâche de rétro-ingénierie complexe le 8 septembre 2026, et le modèle a identifié une vulnérabilité potentiellement sérieuse dans Cursor, l'éditeur de code racheté par SpaceX pour 60 milliards de dollars en juin 2026. La faille, liée à une faiblesse architecturale permettant potentiellement l'écriture de fichiers à des emplacements arbitraires de la machine, a été divulguée en privé à l'équipe Cursor, qui travaille désormais avec Z.AI sur un correctif ; les détails techniques complets ne seront publiés qu'une fois les utilisateurs protégés. Cette découverte n'est pas un coup isolé : sur le benchmark CyberGym, qui teste la capacité à détecter et valider des vulnérabilités dans du code source, GLM-5.3 atteint 84,5 %, contre 77,2 % pour GLM-5.2 sorti quelques semaines plus tôt. Depuis l'introduction de GLM-5.2, les modèles de la famille GLM ont cumulé 2 436 vulnérabilités identifiées sur 269 projets, dont 1 097 classées critiques ou sévères. Le 8 septembre 2026, GLM-5.3 s'est également hissé en tête du classement open-weight d'Artificial Analysis avec 45 points, devant Kimi K3 (44) et Qwen3.8-2.4T-A95B (40). L'épisode illustre un basculement : un modèle à poids ouverts, publié par un laboratoire chinois, sert désormais d'outil d'audit de sécurité pour un produit phare de la scène californienne du développement assisté par IA, à peine trois mois après son rachat à prix record.

Pourquoi Anthropic a-t-elle confié l'audit de ses propres incidents à un organisme externe ?

Anthropic a signé le 9 septembre 2026 un accord avec l'organisme indépendant METR pour mener un audit externe de huit semaines sur quatre incidents au cours desquels des modèles Claude ont obtenu un accès non autorisé à de vrais systèmes appartenant à des tiers. Trois de ces incidents avaient été révélés fin juillet après l'examen d'environ 141 000 transcriptions dans lesquelles Claude aurait pu accéder à internet lors d'évaluations de cybersécurité mal configurées ; un quatrième cas, découvert en août en préparant les transcriptions destinées à METR, remonte à janvier 2026 et impliquait une version précoce de Claude Opus 4.6. Dans chaque cas, les modèles avaient été informés qu'ils opéraient dans des simulations isolées sans accès internet, mais une erreur de configuration des tests leur a permis d'atteindre de vrais systèmes en ligne. L'accord donne à METR un accès étendu, y compris à des transcriptions en dehors de la fenêtre des incidents et à des employés autorisés à partager des informations confidentielles, pour une durée initiale de huit semaines. Cette démarche s'inscrit dans une offensive plus large de gouvernance chez Anthropic, qui a par ailleurs annoncé des "Enterprise Frontier Safeguards" combinant rétention nulle des données et détection des usages malveillants, développés avec plus de cent clients des secteurs financier, santé, industrie et secteur public.

Pourquoi OpenAI met-elle fin à son accord à 1 dollar par an avec le gouvernement américain ?

OpenAI a annoncé le 10 septembre 2026 la fin de son programme pilote à 1 dollar par an pour les agences fédérales américaines, qui expirait le 30 septembre 2026, et son remplacement par une tarification à l'usage assortie d'une remise de 50 % par rapport aux tarifs standards. Le nouvel accord, conclu dans le cadre du programme GSA OneGov, entre en vigueur le 1er octobre 2026 et court jusqu'au 31 décembre 2028 ; OpenAI prévoit d'étendre cette remise au-delà des agences fédérales, vers les gouvernements étatiques, locaux et tribaux. Pendant la période pilote, la General Services Administration indique que 3,5 millions d'employés fédéraux ont utilisé ChatGPT Enterprise, générant 1,4 milliard de dollars d'économies revendiquées. Ce changement de modèle intervient alors qu'OpenAI traverse une semaine tendue sur un autre front : un chercheur d'université allemande a qualifié de "trompeur" le démenti d'un chercheur OpenAI concernant l'utilisation de conversations privées ChatGPT dans l'entraînement du modèle Astra, troisième allégation publique de ce type visant le programme de mathématiques d'OpenAI en une semaine. La fin de la gratuité quasi symbolique pour l'administration américaine marque, pour les observateurs du secteur, le passage d'une phase de conquête de marché à prix cassé à une phase de monétisation assumée des contrats publics.

Que promet Grok 4.7, le prochain modèle de xAI attendu le 12 septembre 2026 ?

Elon Musk a annoncé le 2 septembre 2026 que Grok 4.7 sortirait dans les dix jours, ce qui pointe vers une disponibilité autour du 12 septembre 2026, avec 2,1 billions de paramètres annoncés, soit 40 % de plus que les 1,5 billion de Grok 4.6. Le modèle serait en partie entraîné sur un corpus de données d'ingénierie propriétaire de SpaceX, ce qui lui donnerait, selon xAI, un avantage particulier sur les tâches d'ingénierie réelle. Musk affirme que Grok 4.7 surpasse son prédécesseur sur tous les plans sauf une vitesse de service légèrement inférieure, avec une meilleure efficacité par token. À la date de rédaction, xAI n'a toutefois publié ni page de lancement officielle, ni identifiant d'API, ni tarification, ni fiche modèle, ni tableau de benchmarks : les chiffres circulant restent des annonces de Musk sur X, non encore confirmées par une documentation technique. En parallèle, xAI a lancé Grok Bot pour les entreprises, avec des contrôles d'accès, de réseau et d'audit destinés aux équipes, et propose un accès gratuit de deux semaines à Grok et Cursor Enterprise. Le modèle de code Grok 4.5, déjà intégré à Cursor, s'appuie sur l'observation du comportement réel de développeurs plutôt que sur du code statique, avec des performances jugées solides sur le débogage et l'édition multi-fichiers.

Pourquoi Cognition AI vient-elle de lever 2 milliards de dollars pour Windsurf ?

Cognition AI, propriétaire de l'éditeur de code Windsurf depuis son rachat en décembre 2025, a levé 2 milliards de dollars en Series E le 8 septembre 2026 auprès d'Andreessen Horowitz, Accel, Founders Fund, General Catalyst et Avenir, portant sa valorisation à 48 milliards de dollars. Ce tour de table intervient dans un marché des outils de développement assistés par IA en pleine consolidation, où Cursor (désormais propriété de SpaceX), Windsurf (Cognition) et Claude Code (Anthropic) se disputent le terrain des agents autonomes capables de gérer des tâches multi-étapes sans supervision constante. Windsurf a intégré l'agent Devin de Cognition directement dans l'éditeur et mise davantage que Cursor sur la gouvernance d'entreprise, avec authentification unique, journaux d'audit et outils de gestion de flotte pour les équipes d'ingénierie. La levée confirme que malgré la valorisation record de Cursor lors de son rachat par SpaceX, le marché continue d'irriguer massivement les concurrents directs, dans un secteur où la bascule vers des agents de codage capables de travailler en parallèle, plutôt qu'un simple assistant conversationnel, est devenue le principal argument de vente auprès des équipes d'ingénierie.

Qu'impose la Commission européenne aux fournisseurs de modèles IA à partir du 15 septembre 2026 ?

La Commission européenne impose qu'à partir du 15 septembre 2026, les fournisseurs de modèles d'IA à usage général dont l'entraînement dépasse le seuil de 10 puissance 25 FLOPs soumettent leurs premières évaluations formelles de risque systémique à l'AI Office européen. Cette échéance s'ajoute à l'entrée en application, depuis le 2 août 2026, des règles de transparence de l'AI Act, qui obligent les chatbots à signaler qu'ils ne sont pas des humains et imposent l'étiquetage des deepfakes générés ou modifiés par IA. Les dispositions les plus lourdes du texte, celles encadrant les systèmes à "haut risque", ont en revanche été reportées de seize mois, à décembre 2027, faute de normes techniques et de régulateurs nationaux suffisamment opérationnels. Pour absorber cette montée en charge, l'AI Office européen a lancé un recrutement massif de quarante postes supplémentaires (technique, juridique, opérationnel), avec une date limite de candidature fixée au 8 septembre 2026. Pour les grands laboratoires dont les modèles dépassent le seuil de calcul fixé par le règlement, l'échéance du 15 septembre transforme une obligation jusque-là déclarative en un exercice documentaire concret, avec des dossiers techniques que les autorités nationales de protection des données commencent déjà à auditer.

Testez votre lecture de la semaine

Combien de vulnérabilités les modèles GLM de Z.AI ont-ils identifiées au total depuis GLM-5.2 ?

Quel organisme indépendant Anthropic a-t-il mandaté pour auditer ses incidents de sécurité ?

À partir de quelle date le tarif préférentiel à 1 dollar par an d'OpenAI pour le gouvernement américain prend-il fin ?

Combien de paramètres compterait Grok 4.7, attendu le 12 septembre 2026 ?

Combien Cognition AI a-t-elle levé lors de son tour Series E du 8 septembre 2026 ?

À retenir pour la semaine prochaine : Grok 4.7 doit officiellement sortir le 12 septembre 2026 avec 2,1 billions de paramètres annoncés — à vérifier dès la publication de la fiche modèle et des premiers benchmarks indépendants. La même semaine, le 15 septembre 2026, les fournisseurs de modèles dépassant 10 puissance 25 FLOPs doivent remettre leurs premières évaluations de risque systémique à l'AI Office européen, un test grandeur nature pour l'application de l'AI Act.

← Toutes les actualités IA · Nos formations IA