Claude d'Anthropic dans le viseur des États et des cybercriminels : ce que révèle le rapport de menaces de septembre 2026
Anthropic vient de publier son quatrième rapport de renseignement sur les menaces liées à l'IA, couvrant la période de décembre 2025 à août 2026. Le constat est sans ambiguïté : des acteurs étatiques liés à la Russie et à la Chine, des gangs cybercriminels et des réseaux de propagande ont activement cherché à exploiter Claude à des fins malveillantes. Ce rapport n'est pas un exercice de communication. C'est un document de travail qui change la donne sur ce que l'on entend par "risque IA".
Un rapport qui sort des sentiers battus
La plupart des rapports de sécurité dans le secteur de l'IA restent volontairement vagues. Anthropic prend le contre-pied de cette tendance. Son quatrième rapport de renseignement sur les menaces, disponible directement sur le site officiel d'Anthropic, nomme des acteurs, décrit des méthodes et quantifie des volumes d'attaques. C'est précisément ce niveau de détail qui en fait un document aussi précieux qu'inconfortable.
Neuf mois de surveillance, plusieurs centaines de comptes identifiés et compromis, sept catégories de menaces distinctes. Ce n'est pas un scénario de science-fiction. Ce sont des faits documentés, survenus entre décembre 2025 et août 2026.
Les 7 catégories de menaces identifiées
Le rapport structure les abus recensés en sept grandes familles. Chacune correspond à un mode opératoire bien distinct, avec des acteurs et des objectifs propres.
- Cyberattaques automatisées : utilisation de Claude pour générer du code malveillant, identifier des failles et automatiser des campagnes d'intrusion à grande échelle.
- Recherche sur les armes biologiques : tentatives d'extraction d'informations relatives à la synthèse ou à la manipulation d'agents pathogènes. The National News a consacré une analyse spécifique à ce volet particulièrement sensible.
- Surveillance de masse : ciblage de dissidents ouïghours grâce à des outils d'analyse et de profilage assistés par l'IA.
- Espionnage : extraction d'informations stratégiques, cartographie de réseaux et soutien à des opérations de renseignement étatiques.
- Opérations d'influence : production de contenu de propagande, création de faux profils et amplification automatisée de narratifs politiques.
- Distillation illicite : extraction systématique des capacités de Claude pour entraîner d'autres modèles, en contournant les conditions d'utilisation.
- Fraude et usurpation : utilisation de Claude pour générer du contenu frauduleux, des arnaques ciblées ou des tentatives d'hameçonnage sophistiquées.
CyberScoop a particulièrement mis en lumière les capacités de cyberattaque assistées par l'IA détaillées dans ce rapport, soulignant que l'automatisation change fondamentalement l'échelle des menaces possibles.
L'affaire Alibaba : 151 millions d'échanges pour voler un modèle
Parmi tous les cas documentés, celui qui implique Alibaba est sans doute le plus spectaculaire par son ampleur industrielle. Ce n'est pas une tentative d'intrusion opportuniste. C'est une opération méthodique, quasi commerciale dans son organisation.
Chiffres clés : l'opération Alibaba
| Période observée | Mai à juillet 2026 |
| Volume total d'échanges | 151 millions |
| Rythme quotidien | 3 millions d'échanges par jour |
| Comptes frauduleux identifiés | 3 500 |
| Objectif | Extraire les capacités de Claude Opus pour entraîner Qwen |
Concrètement, la technique utilisée s'appelle la "distillation de modèle". L'idée est simple : on soumet massivement des questions à un modèle puissant, on collecte ses réponses, et on utilise ce corpus pour entraîner son propre modèle. Le résultat est un clone partiel, obtenu sans développer le savoir-faire sous-jacent et sans respecter les droits du créateur du modèle original.
Trois mille cinq cents comptes frauduleux, c'est une infrastructure coordonnée. Pas un individu qui teste des limites un soir de week-end. Selon Reuters, Anthropic a réussi à perturber ces campagnes, mais la question de ce qui a déjà été extrait avant la détection reste ouverte.
DeepSeek et Moonshot AI : le détournement silencieux
Autre révélation particulièrement troublante du rapport : DeepSeek et Moonshot AI, deux acteurs chinois du secteur de l'IA, ont redirigé silencieusement les requêtes de leurs propres utilisateurs vers Claude. Sans que ces derniers le sachent.
Ce procédé soulève deux problèmes majeurs. D'abord, une violation évidente des conditions d'utilisation d'Anthropic. Ensuite, et c'est sans doute plus grave pour les utilisateurs concernés, une question de transparence fondamentale : qui parle réellement à vos données ? Quand vous utilisez un outil présenté comme un modèle chinois indépendant, vous attendez-vous à ce que vos échanges transitent en réalité par l'infrastructure d'une entreprise américaine ?
Ce type de pratique, si elle se généralisait, rendrait toute politique de souveraineté numérique particulièrement difficile à tenir. Politico rappelle d'ailleurs que ces pratiques s'inscrivent dans un contexte de tension géopolitique plus large autour du contrôle des capacités IA.
Russie, Chine et cybercriminels : qui fait quoi
Le rapport ne se contente pas de désigner des pays. Il différencie les modes opératoires selon les acteurs. Les groupes liés à la Russie se distinguent particulièrement dans les opérations d'influence et les cyberattaques orientées vers des cibles occidentales. Les acteurs liés à la Chine, eux, apparaissent davantage dans la distillation illicite, la surveillance et l'espionnage industriel.
Les gangs cybercriminels, de leur côté, exploitent surtout les capacités de génération de code et d'automatisation pour industrialiser des attaques qui nécessitaient auparavant des équipes techniques importantes. L'IA abaisse drastiquement le coût d'entrée dans la cybercriminalité sophistiquée. C'est probablement l'une des conséquences les plus durables de ces abus.
"Les capacités d'automatisation offertes par les grands modèles de langage ont fondamentalement modifié l'économie des cyberattaques. Ce qui nécessitait une équipe, un budget et du temps peut aujourd'hui être orchestré par un acteur unique disposant d'un accès à l'API."
Synthèse du rapport de renseignement Anthropic, septembre 2026
OpenAI et Anthropic demandent au Congrès d'agir
Face à ces constats, Anthropic et OpenAI ont fait un geste inhabituel dans un secteur qui cultive souvent la concurrence féroce : ils ont appelé conjointement le Congrès américain à adopter des règles de sécurité obligatoires pour les systèmes d'IA.
L'appel commun de deux concurrents directs sur un sujet aussi sensible mérite attention. Les deux entreprises semblent avoir conclu que la régulation volontaire ne suffit plus. Les abus documentés dans ce rapport en sont la démonstration concrète. Sans cadre légal contraignant, les garde-fous techniques restent contournables, et les acteurs malveillants disposent d'un avantage structurel : ils n'ont aucune contrainte à respecter.
La demande est claire : des obligations de sécurité, de transparence et de signalement des incidents, avec une portée extraterritoriale pour couvrir les acteurs étrangers accédant aux API américaines. Ce n'est pas encore une loi. Mais c'est un signal fort que les acteurs les plus influents du secteur ont pris la mesure du problème.
Ce que ce rapport change pour les entreprises qui utilisent l'IA
Si vous utilisez Claude, ou tout autre grand modèle de langage, dans vos processus métier, ce rapport vous concerne indirectement mais concrètement. Pas parce que votre entreprise est une cible prioritaire. Mais parce que l'écosystème dans lequel vous évoluez est sous pression, et que les répercussions de ces abus peuvent affecter la disponibilité, les politiques d'accès ou les conditions tarifaires des API que vous utilisez.
Plus fondamentalement, ce rapport rappelle que l'IA n'est pas un outil neutre. Sa puissance est réelle dans les deux sens du terme : elle peut accélérer vos processus, et elle peut accélérer ceux de vos adversaires. La sécurité de l'IA n'est plus un sujet réservé aux équipes techniques des grands labos. C'est une préoccupation de gouvernance pour toute organisation qui intègre ces outils dans ses opérations critiques.
L'intégration responsable de l'IA passe par une compréhension honnête de ce contexte. Choisir un fournisseur, c'est aussi choisir un niveau de rigueur en matière de sécurité et de transparence. Ce rapport d'Anthropic, avec toutes ses révélations inconfortables, est précisément le type de document qui permet d'évaluer cette rigueur.
Notre point de vue
La publication de ce rapport est en elle-même un acte de transparence que l'on peut saluer. Beaucoup d'entreprises auraient géré ces incidents en silence, pour protéger leur réputation. Anthropic a fait le choix inverse : nommer les acteurs, quantifier les volumes, décrire les méthodes. C'est risqué en termes d'image. C'est utile pour l'ensemble de l'industrie.
Cela dit, ce rapport soulève aussi des questions sur la suffisance des mécanismes de détection actuels. Si 151 millions d'échanges frauduleux ont pu avoir lieu sur trois mois avant d'être détectés et perturbés, combien d'opérations similaires restent sous le radar ? La détection après coup est utile. La prévention reste le défi non résolu.
L'appel conjoint au Congrès est également révélateur d'un changement de posture de l'industrie. Les acteurs dominants comprennent désormais que la course à la puissance technologique sans cadre légal crée des externalités négatives qu'ils ne peuvent plus absorber seuls. La régulation, longtemps perçue comme un frein, est désormais présentée comme un outil de protection. C'est un glissement rhétorique qui mérite d'être noté.
Pour aller plus loin
Consultez les sources primaires qui ont nourri cet article :
Ce rapport place une question centrale sur la table : à mesure que l'IA devient un outil de travail standard, comment s'assure-t-on que les garde-fous évoluent au même rythme que les capacités ? Ce n'est pas une question technique. C'est une question de choix collectif — et le débat au Congrès américain sera l'un des premiers endroits où ce choix se formalisera.