Entre janvier et juillet, Anthropic a neutralisé plusieurs campagnes originaires de Chine, d’Iran et d’Afrique de l’Ouest utilisant son IA Claude pour surveiller des figures prodémocratie de Hong Kong, des communautés tibétaines ou encore des opposants iraniensL’américain Anthropic a annoncé jeudi avoir stoppé plusieurs opérations de surveillance menées contre des dissidents et des minorités ethniques à l’aide de son assistant d’intelligence artificielle (IA) Claude.Ces incidents, détectés et neutralisés entre janvier et juillet, provenaient de Chine, d’Iran et d’Afrique de l’Ouest, selon un rapport d’Anthropic consacré aux différents détournements de ses modèles.
Lire aussi: Sur fond de polémique, OpenAI annonce avoir résolu l’équation de Navier-Stokes, vieille de deux siècles
Ces campagnes de surveillance «ont visé les mêmes communautés de la diaspora et les mêmes dissidents que ces régimes ciblent historiquement, notamment des figures prodémocratie à Hong Kong, les communautés tibétaines et du Falun Gong à travers l’Asie, ainsi que des minorités iraniennes et des opposants au régime iranien à l’étranger», indique le rapport.
Recherches biologiques douteuses
Dans un cas, des acteurs iraniens ont mis au point un moyen d’identifier des personnes à partir de leurs comptes sur les réseaux sociaux. Dans un autre, un prestataire travaillant pour les autorités de sécurité nationale du Mali a utilisé Claude «pour concevoir le logiciel sur lequel reposait la collecte de renseignements».Anthropic rapporte également avoir déjoué des tentatives de concevoir des armes, de mener des recherches biologiques douteuses ou de créer de fausses applications de rencontre afin d’escroquer les utilisateurs.
Lire aussi: «Nous naviguons en eaux inconnues»: certains risques posés par l’intelligence artificielle pourraient devenir «existentiels»
L’entreprise de San Francisco accuse aussi nommément les chinois Moonshot et DeepSeek d’avoir utilisé Claude en cachette pour répondre aux questions de leurs utilisateurs, tout en récupérant les résultats pour améliorer leurs propres modèles. Des développeurs chinois avaient déjà été accusés de recourir sans autorisation à cette pratique, la «distillation», aux dépens de laboratoires américains comme Anthropic et OpenAI.
Violation potentielle des règles de confidentialité
«Dans un cas, sur une période de dix jours, Moonshot a relayé près de 300 000 requêtes de clients à Anthropic» par le biais d’un «réseau de 5380 comptes frauduleux, dont la plupart semblaient situés à Singapour et au Japon», selon le rapport.
Lire aussi: Que savent exactement ChatGPT et Claude sur vous? Proton lance un outil pour le révéler
Une partie de ces données contenait des informations sensibles sur les utilisateurs, en violation potentielle des règles de confidentialité. «Nous ne savons pas si Moonshot a informé ses clients que leurs requêtes étaient redirigées vers Anthropic et exposées à un tiers», indique le rapport.Pour les recherches biologiques bloquées, les intentions des auteurs étaient moins claires et le laboratoire ne les a pas identifiés. «Les personnes impliquées dans ces études de cas sont des scientifiques en activité. Nous n’affirmons pas qu’elles avaient l’intention de nuire, et les identifier, elles ou leurs laboratoires, pourrait les mettre en danger», précise le rapport.Ces travaux portaient sur le virus du chikungunya, transmis par les moustiques, sur une souche «hautement pathogène» de la grippe aviaire, sur une famille de virus qui comprend la variole et le mpox, ainsi que sur des venins et d’autres toxines.
Pour offrir la meilleure expérience, nous utilisons des technologies telles que les cookies afin de stocker et/ou d’accéder à des informations sur votre appareil. En consentant à ces technologies, vous nous permettez de traiter des données telles que votre comportement de navigation ou des identifiants uniques sur ce site. Ne pas consentir ou retirer son consentement peut affecter négativement certaines fonctionnalités et fonctions.