Anthropic affirme que des acteurs malveillants russes et chinois ont utilisé son modèle d’IA « Claude » à des fins malveillantes
L’entreprise a indiqué que parmi les acteurs malveillants figuraient des groupes soupçonnés d’être soutenus par des États, des criminels motivés par l’appât du gain, des fournisseurs de logiciels espions à des fins commerciales, des institutions de propagande d’État et des individus animés par des motivations politiques.
Selon son rapport, la plupart des cyberopérations détectées entre décembre 2025 et août 2026 ont été rendues possibles par l’IA, soit par exécution directe, soit par orchestration. Les humains sont toutefois restés impliqués dans la sélection des cibles et le contrôle de l’exfiltration, a-t-elle précisé.
« L’utilisation de l’IA allait au-delà des simples questions-réponses d’un chatbot ; elle impliquait plutôt le recours à des frameworks multi-agents exécutant des opérations de reconnaissance, d’exploitation et d’exfiltration de données », a déclaré Anthropic.
Parmi les acteurs malveillants cités par l’entreprise figurait un groupe lié à Midnight Blizzard, basé en Russie. Anthropic a affirmé que ce groupe avait utilisé l’IA pour attaquer des cibles des services de renseignement militaire en Ukraine et en Europe, ainsi que des organisations diplomatiques et de défense et des personnes liées à la politique étrangère américaine.
Anthropic a déclaré avoir également déjoué des attaques de « distillation » contre Claude menées par sept laboratoires basés en Chine, notamment des opérateurs qui seraient liés à Alibaba, DeepSeek, Xiaomi et Moonshot.
L’entreprise a défini la « distillation » comme « une campagne secrète à l’échelle industrielle » visant à extraire illégalement les capacités d’un modèle d’IA pour les reproduire dans un autre modèle.
Des opérateurs liés à Alibaba, la plus grande plateforme de commerce électronique chinoise, ont mené la plus grande attaque de « distillation » afin d’améliorer les capacités de raisonnement des modèles d’Alibaba, générant plus de 151 millions d’échanges entre mai et juillet 2026, selon le rapport. Cette activité a atteint un pic de près de 3 millions d’échanges par jour, émis à partir de plus de 3500 comptes qu’Anthropic a jugés frauduleux.
Anthropic a également affirmé que la société chinoise d’IA Moonshot transférait secrètement les demandes des clients vers Claude, puis présentait les réponses obtenues aux utilisateurs comme si elles avaient été générées par son propre modèle d’IA, Kimi.
Dans un cas précis, Moonshot aurait acheminé près de 300.000 demandes de clients vers le modèle d’Anthropic sur une période de 10 jours en utilisant un réseau de services proxy composé de 5380 comptes frauduleux, dont la plupart semblaient être situés à Singapour et au Japon, selon le rapport.
« Notre enquête a également révélé que les requêtes des utilisateurs que Moonshot a redirigées vers Claude comprenaient des informations sensibles concernant divers clients de Moonshot », a déclaré Anthropic.
« Nous ne savons pas si Moonshot a informé ses clients que leurs requêtes étaient redirigées vers Anthropic et exposées à un tiers. »
Le rapport a également identifié de nouvelles catégories d’acteurs malveillants utilisant Claude à des fins abusives, notamment ceux qui cherchent à développer « des logiciels pour des armes conventionnelles, notamment des armes à feu, des missiles, des drones armés, des bombes et d’autres munitions ».
Anthropic a déclaré avoir démantelé une « cellule d’ingénierie d’armes guidées » menant trois programmes de développement d’armes dans le nord du Yémen, qui utilisait Claude « pour développer le logiciel de guidage, de navigation et de contrôle (GNC) permettant de diriger et de stabiliser un engin volant ».
Selon le rapport, les acteurs malveillants auraient procédé à un tir d’essai d’une roquette guidée, mais auraient échoué, ce qui les aurait incités à solliciter l’aide de Claude pour identifier la cause de cet échec.
Parmi les autres acteurs malveillants récemment répertoriés figurait un acteur basé en Chine qui utilisait Claude pour faire avancer trois projets parallèles portant sur « un système d’armes anti-torpilles ».
Anthropic a également identifié des acteurs malveillants indépendants présumés basés en Russie qui cherchaient à construire un « essaim de drones kamikazes autonomes à vue à la première personne » et un autre acteur basé en Russie qui utilisait Claude pour effectuer des recherches et rédiger des documents d’appel d’offres concernant des biens vraisemblablement destinés au gouvernement russe et à des clients de l’industrie de la défense.
L’entreprise a déclaré qu’elle continuerait à renforcer ses mesures de protection et à collaborer avec ses partenaires pour empêcher toute utilisation abusive de son modèle d’IA.
« Dans chaque cas, nous avons mis fin à l’activité, utilisé les enseignements tirés pour renforcer nos mesures de protection et partagé les renseignements avec les autorités et nos partenaires du secteur, le cas échéant », a-t-elle précisé.
yogaesoteric
20 septembre 2026