A Anthropic interrompeu uma série de ações de monitoramento digital operadas por agentes ligados aos governos da China, do Irã e do Mali. As manobras, identificadas entre janeiro e julho deste ano, empregavam o modelo de inteligência artificial Claude para rastrear dissidentes políticos, perseguir minorias e coletar dados de inteligência.
Espionagem direcionada e perseguição política
Os alvos das investidas abrangiam populações que já enfrentam repressão histórica. Entre os grupos vigiados estavam lideranças pró-democracia de Hong Kong, comunidades tibetanas e membros da oposição iraniana que vivem no exterior.
No Irã, operadores criaram métodos para identificar cidadãos a partir do cruzamento de perfis em redes sociais. Já no Mali, um profissional contratado por órgãos de segurança nacional recorreu à ferramenta para estruturar a base de um software voltado especificamente à espionagem governamental.
Extração indevida de dados por desenvolvedores
Além da espionagem estatal direta, programadores chineses foram flagrados utilizando o Claude em processos não autorizados de destilação de modelos. A técnica se baseia em alimentar uma nova IA com as respostas refinadas de um sistema concorrente mais avançado para acelerar o aprendizado do próprio software sem pagar por isso.
Bloqueios envolveram armas e pesquisas com patógenos
O monitoramento interno da companhia também resultou na suspensão de acessos associados ao desenvolvimento de armamentos, esquemas de estelionato amoroso na internet e consultas envolvendo pesquisas biológicas consideradas críticas.
Estudos com vírus e toxinas
As restrições atingiram interações relacionadas ao vírus chikungunya, a uma variante de alta patogenicidade da gripe aviária e a agentes da família dos poxvírus, que inclui a varíola e a mpox, além de venenos e substâncias tóxicas. Como os autores das consultas eram cientistas e não houve comprovação de dolo, as identidades dos pesquisadores e de seus laboratórios foram preservadas para evitar represálias ou riscos indevidos.
Com as suspensões, a desenvolvedora reforça suas diretrizes de segurança com o objetivo de impedir que modelos generativos sejam instrumentalizados para fraudes virtuais, riscos biológicos e vigilância estatal autoritária.








