Le dernier rapport d’Anthropic sur les menaces liées à l’intelligence artificielle révèle une escalade préoccupante dans le détournement de son modèle, Claude. Entre fin 2025 et l’été 2026, des acteurs étatiques, des groupes de cybercriminels et des entreprises technologiques ont massivement exploité cet outil pour des fins illicites. Les révélations pointent vers une utilisation diversifiée allant du développement d'armements sophistiqués à la surveillance de masse, en passant par des campagnes de cyberattaques automatisées. L'entreprise souligne avoir réussi à identifier et à neutraliser ces opérations, tout en insistant sur la nécessité de partager ces données pour renforcer la sécurité collective face à une menace qui gagne en autonomie.

Les faits mis en lumière illustrent une utilisation hybride et transnationale de l’IA. Des groupes liés aux services de renseignement russes, comme Midnight Blizzard, ont tiré profit de Claude pour perfectionner des malwares en temps réel et échapper aux antivirus. Parallèlement, au Mali, un système de surveillance baptisé Lakana 360 a été conçu pour intercepter les communications de millions d'utilisateurs mobiles sans cadre juridique. Plus inquiétant encore, des programmes d'armement impliquant la Russie, la Chine et le Yémen ont utilisé l'IA pour optimiser la conception de missiles et de drones, témoignant d'un changement de paradigme où l'IA devient un bras armé technologique essentiel pour des entités étatiques ou paramilitaires.

Le rapport pointe également du doigt une stratégie de pillage industriel orchestrée par plusieurs laboratoires d’IA chinois. Par une technique dite de « distillation », des entreprises comme Alibaba, Moonshot AI ou DeepSeek ont siphonné le raisonnement de Claude pour renforcer leurs propres modèles, cumulant des centaines de millions d'échanges frauduleux. Ces manœuvres incluaient parfois l'extraction de données sensibles ou d'identifiants à l'insu des utilisateurs finaux, révélant une compétition acharnée et déloyale au sein de l'écosystème de l'IA générative. La portée de ce phénomène est massive : des milliers de comptes ont été mobilisés pour automatiser des arnaques sentimentales à grande échelle, ciblant des dizaines de milliers de victimes en quelques semaines.

L’ampleur de ces détournements marque un tournant dans la gestion des risques liés à la sécurité informatique. Anthropic affirme que ces agents IA, dans certains cas, ont opéré de manière quasi autonome, limitant le besoin d'intervention humaine pour des tâches complexes de piratage ou de surveillance. Ces incidents, bien que neutralisés, soulèvent des enjeux critiques de gouvernance pour les géants de la Silicon Valley, désormais confrontés à des adversaires capables d'utiliser leur propre technologie contre eux. Si le partage d'informations avec les autorités et le renforcement des garde-fous demeurent des priorités, cette situation confirme que l'IA est devenue un nouveau champ de bataille géopolitique où la distinction entre innovation et menace est devenue plus que jamais poreuse.