O AGENTICO
The Wall Street Journal revela uso de Claude em ataque à OpenAI
12 fontesdesde 18 de setembro de 202614 artigos
O jornal The Wall Street Journal revelou um ataque da equipe Hacktron à OpenAI, que usou o modelo Claude da Anthropic para explorar uma falha no processamento de imagens do fórum Discourse. Os pesquisadores acessaram contas de funcionários e o repositório de código no GitHub, e a OpenAI corrigiu as vulnerabilidades em até 14 horas após o relato.



Resumo
Pesquisadores de segurança da Hacktron invadiram contas de funcionários da OpenAI usando o modelo Claude da Anthropic.
Mostra uso de IA avançada para ataques cibernéticos em curto prazo.
O ataque explorou uma falha no processamento de imagens em um fórum da OpenAI, permitindo acesso ao repositório de código no GitHub.
Detalha a vulnerabilidade usada e o caminho até dados internos.
A invasão foi conduzida sob o programa de bug bounty da OpenAI, e os pesquisadores reportaram a falha à empresa.
Indica que foi um teste de segurança coordenado e recompensado.
A OpenAI agradeceu aos pesquisadores e afirmou ter resolvido as vulnerabilidades exploradas.
Confirma que a empresa conseguiu corrigir o problema após a notificação.
O ataque foi inicialmente atribuído ao Claude Opus 4.8, mas os pesquisadores usaram principalmente o GPT-5.6 Sol da OpenAI.
Divergência entre os relatos sobre qual modelo foi central para o ataque.
Pesquisadores da Hacktron usaram o Claude, da Anthropic, para explorar uma falha no fórum Discourse da OpenAI e acessar contas de funcionários e o repositório de código no GitHub.
O uso de IA generativa em ataques cibernéticos demonstra a crescente capacidade de modelos como o Claude em auxiliar na exploração de vulnerabilidades.
Os pesquisadores da Hacktron receberam US$ 6,5 mil como recompensa da OpenAI pelo relato da vulnerabilidade.
O valor da recompensa mostra o reconhecimento da OpenAI pela descoberta e reporte responsável da falha.
O ataque começou em 23 de julho, quando os pesquisadores encontraram uma vulnerabilidade no processamento de arquivos de imagem no Discourse, plataforma usada no fórum da comunidade da OpenAI.
A data de início e o ponto de entrada detalham como a cadeia de exploração foi iniciada.
A vulnerabilidade explorada está relacionada a uma falha no libheif, afetando o processamento de formatos de imagem como HEIC e AVIF.
O libheif é usado em várias plataformas, o que aumenta o impacto potencial da falha além da OpenAI.
A OpenAI corrigiu as vulnerabilidades exploradas em até 14 horas após o relato dos pesquisadores.
A rapidez na correção indica a seriedade com que a empresa tratou o incidente.
A Hacktron usou inicialmente o Claude Opus 4.8, mas enfrentou dificuldades; o lançamento do Claude Opus 5 foi decisivo para o sucesso do ataque.
A evolução dos modelos de IA é central para entender por que o ataque foi possível em tão pouco tempo.
Apesar do uso inicial do Claude, os pesquisadores usaram principalmente o GPT-5.6 Sol, modelo da própria OpenAI, para executar o ataque.
O fato de terem usado o modelo da própria OpenAI para invadi-la é um contraste irônico e relevante.
O ataque da Hacktron começa com uma falha no processamento de imagens no fórum Discourse da OpenAI, que permitiu o acesso às contas de funcionários de ChatGPT.
O vetor de ataque foi uma vulnerabilidade no processamento de imagens em um serviço de terceiros usado pela OpenAI, demonstrando como falhas em dependências externas podem comprometer grandes empresas.
Os pesquisadores da Hacktron divulgaram detalhes do ataque em um post no X em 18 de setembro, após a correção das falhas pela OpenAI.
A divulgação pública do ataque após a correção é uma prática comum em bug bounty, mas também serve para destacar a sofisticação crescente de ataques com IA.
Além do Claude Opus 5, os pesquisadores usaram principalmente o GPT-5.6 Sol da OpenAI para executar o ataque, segundo os próprios pesquisadores.
A informação de que o modelo da própria OpenAI foi usado na maior parte do ataque diverge da narrativa inicial que focava apenas no Claude, mostrando a complexidade do incidente e também o potencial ofensivo dos próprios modelos da empresa.
O ataque foi possível combinando uma falha de processamento de imagem (libheif) com uma configuração incorreta de login único (SSO) e uma vulnerabilidade de execução remota de código (RCE) no Discourse.
A cadeia de exploração mostra a vulnerabilidade no processo de upload de imagens e como falhas combinadas podem levar ao acesso total ao sistema.
A OpenAI afirmou que resolveu as vulnerabilidades exploradas e agradeceu aos pesquisadores pelo contato.
A resposta rápida da empresa e o reconhecimento público são as melhores práticas, mas também são uma resposta a um incidente que poderia ter sido muito mais grave.
Segundo o CTO da Hacktron, Mohan Pedhapati, ele e sua equipe são apenas três pessoas usando assinaturas do Claude e do Codex, e ele não acredita que sejam tão fortes quanto agentes de ameaças chineses.
A declaração reforça a preocupação sobre o acesso barato a ferramentas de IA para fins maliciosos, mesmo por pequenos grupos, e compara o nível de sofisticação com ameaças patrocinadas por estados.
Citações
“An OpenAI spokesperson said “we thank the researchers for contacting us and sharing their findings”, adding that the company had addressed the vulnerabilities that had been exploited.”
— Porta-voz da OpenAI, Porta-voz
“An OpenAI spokesperson said “we thank the researchers for contacting us and sharing their findings”, adding that the company had addressed the vulnerabilities that had been exploited.”
— Porta-voz da OpenAI, Porta-voz
“I don’t think we are as strong as Chinese threat actors. We’re just three guys with Claude and Codex subscriptions.”
— Mohan Pedhapati, CTO da Hacktron AI
Todo dia, só o que dois veículos independentes confirmaram — no seu feed.