O AGENTICO
Anthropic identifica países que usaram Claude para armas biológicas e propaganda
4 fontesdesde 10 de setembro de 202610 artigos
A Anthropic divulgou um relatório de inteligência de ameaças detalhando casos de uso malicioso de seu modelo Claude, incluindo tentativas de desenvolvimento de armas biológicas, propaganda e ataques cibernéticos. A empresa bloqueou as operações, mas admitiu dificuldades em distinguir pesquisas legítimas de intenções maliciosas. O relatório também destacou ataques de empresas chinesas para extrair capacidades do modelo.



Resumo
A Anthropic identificou países que tentaram usar sua tecnologia para desenvolver propaganda, drones de guerra e possíveis armas biológicas, e bloqueou o produto em todas as tentativas detectadas.
A empresa de IA Claude afirma ter impedido usos maliciosos de sua tecnologia, incluindo tentativas de criar armas biológicas.
A Anthropic interrompeu, neste ano, várias tentativas de cientistas que usaram seus modelos de IA para pesquisas que poderiam contribuir para o desenvolvimento de armas biológicas.
O fato mostra como a empresa lida com o 'duplo uso' de suas tecnologias, equilibrando avanços médicos legítimos com riscos de uso malicioso.
A Anthropic não conseguiu distinguir se as pesquisas bloqueadas tinham finalidade legítima, como a criação de vacinas, ou maliciosa, e optou por agir com cautela diante do risco.
A incerteza sobre a intenção dos pesquisadores levou a empresa a adotar uma postura conservadora, interrompendo atividades que poderiam ser benéficas para evitar potenciais danos.
Um dos casos citados pela Anthropic envolveu um pesquisador que pediu ajuda para modificar o vírus chikungunya e torná-lo mais nocivo, em um instituto militar.
O exemplo ilustra o tipo de atividade suspeita que a empresa está monitorando, onde a pesquisa poderia ser usada tanto para avanços médicos quanto para armas biológicas.
Os pesquisadores tentaram contornar os controles de acesso e ocultar a finalidade das pesquisas para escapar das salvaguardas, o que levou ao banimento de contas associadas.
A tentativa de burlar as proteções da empresa evidencia a intenção de evitar a detecção, levando a medidas mais rígidas por parte da Anthropic.
Jacob Klein, chefe de inteligência contra ameaças da Anthropic, disse que a intenção maliciosa raramente é explícita nas conversas, tornando a detecção um desafio.
A dificuldade de identificar intenções maliciosas é um ponto central que explica a postura cautelosa da empresa e a complexidade de usar IA com segurança.
A Anthropic também frustrou ataques de 'destilação ilícita' conduzidos por laboratórios de IA chineses, como Alibaba, Moonshot, DeepSeek e Xiaomi, que tentavam extrair recursos do modelo Claude.
Além do risco de armas biológicas, a empresa enfrenta pressões de concorrentes que buscam copiar suas tecnologias, mostrando a diversidade de ameaças à propriedade intelectual.
A Anthropic identificou países como Rússia, China, Irã e Iêmen que tentaram usar o Claude para propaganda, desenvolvimento de drones de guerra e possíveis armas biológicas, bloqueando todas as tentativas detectadas.
O relatório mostra como a IA pode ser explorada por estados para fins ofensivos, incluindo propaganda e armamento.
Citações
“Você não vê alguém, como num gibi, dizendo: 'Ei, quero construir uma arma biológica para matar todo mundo'", disse Jacob Klein, chefe de inteligência contra ameaças da Anthropic, em entrevista. "É uma situação extremamente complexa.”
— Jacob Klein, chefe de inteligência contra ameaças da Anthropic
Todo dia, só o que dois veículos independentes confirmaram — no seu feed.