A empresa de inteligência artificial Anthropic revelou, em um relatório técnico divulgado nesta quinta-feira, que sua tecnologia foi utilizada de forma indevida para a execução de ataques cibernéticos. Segundo a companhia, os serviços do modelo Claude foram explorados por um agente malicioso francófono durante a primavera de 2026 para estruturar operações de intrusão digital contra diversas organizações sediadas na Europa.
O incidente destaca os desafios crescentes relacionados à segurança de sistemas de IA, que podem ser instrumentalizados para otimizar táticas de espionagem e exfiltração de dados. A empresa, que se posiciona como uma referência em segurança de sistemas autônomos, detalhou como a ferramenta foi integrada ao fluxo de trabalho do atacante para contornar defesas tradicionais.
Alvos e impacto da operação cibernética
A investigação da Anthropic aponta que a campanha de ataques teve como foco principal entidades francesas ligadas à extrema-direita. Entre os 42 alvos identificados pelo agente, foram atingidos partidos políticos, institutos de formação, veículos de comunicação — incluindo a revista Frontières — e fóruns de discussão. O invasor obteve sucesso em pelo menos 14 dessas organizações, resultando no vazamento de 12 a 26 gigabytes de dados sensíveis, como listas de membros e informações de doadores.
Metodologia e uso de subagentes de IA
O relatório técnico descreve uma operação sofisticada, na qual o atacante desenvolveu uma ferramenta personalizada em linguagem Rust para identificar chaves de API expostas em ambientes públicos. Após a validação, o tráfego era mascarado por meio de proxies locais, dificultando a detecção da origem real da intrusão. O uso da IA foi central para automatizar o reconhecimento de sistemas e a revisão de códigos maliciosos.
O agente explorou as capacidades de programação autônoma do modelo para gerir subagentes, que operavam de forma coordenada. Essas instâncias eram responsáveis por realizar o reconhecimento antes e depois da autenticação, além de validar os resultados produzidos por diferentes modelos de linguagem, aumentando a eficiência do ataque contra os alvos selecionados.
Segurança e o futuro da inteligência artificial
Este caso reforça o debate global sobre a governança de modelos de linguagem de grande escala. A Anthropic tem buscado implementar salvaguardas para evitar o uso indevido de sua tecnologia em atividades como propaganda, ciberataques e desenvolvimento de armas biológicas. A empresa mantém um monitoramento constante para identificar padrões de comportamento que indiquem o uso de seus sistemas para fins ilícitos.
Para mais informações sobre as diretrizes de segurança da empresa, consulte o site oficial da Anthropic. O episódio serve como um alerta para organizações sobre a necessidade de proteger chaves de acesso e monitorar vulnerabilidades em infraestruturas digitais diante da evolução das ameaças automatizadas.