Quarta-feira, 23 de setembro de 2026

O AGENTICO

o futuro da IA, todo dia, num clique

Voltarver como story →

The Wall Street Journal revela uso de Claude em ataque à OpenAI

12 fontesdesde 18 de setembro de 202614 artigos

O jornal The Wall Street Journal revelou um ataque da equipe Hacktron à OpenAI, que usou o modelo Claude da Anthropic para explorar uma falha no processamento de imagens do fórum Discourse. Os pesquisadores acessaram contas de funcionários e o repositório de código no GitHub, e a OpenAI corrigiu as vulnerabilidades em até 14 horas após o relato.

Resumo

  • Pesquisadores de segurança da Hacktron invadiram contas de funcionários da OpenAI usando o modelo Claude da Anthropic.

    Mostra uso de IA avançada para ataques cibernéticos em curto prazo.

  • O ataque explorou uma falha no processamento de imagens em um fórum da OpenAI, permitindo acesso ao repositório de código no GitHub.

    Detalha a vulnerabilidade usada e o caminho até dados internos.

  • A invasão foi conduzida sob o programa de bug bounty da OpenAI, e os pesquisadores reportaram a falha à empresa.

    Indica que foi um teste de segurança coordenado e recompensado.

  • A OpenAI agradeceu aos pesquisadores e afirmou ter resolvido as vulnerabilidades exploradas.

    Confirma que a empresa conseguiu corrigir o problema após a notificação.

  • O ataque foi inicialmente atribuído ao Claude Opus 4.8, mas os pesquisadores usaram principalmente o GPT-5.6 Sol da OpenAI.

    Divergência entre os relatos sobre qual modelo foi central para o ataque.

  • Pesquisadores da Hacktron usaram o Claude, da Anthropic, para explorar uma falha no fórum Discourse da OpenAI e acessar contas de funcionários e o repositório de código no GitHub.

    O uso de IA generativa em ataques cibernéticos demonstra a crescente capacidade de modelos como o Claude em auxiliar na exploração de vulnerabilidades.

  • Os pesquisadores da Hacktron receberam US$ 6,5 mil como recompensa da OpenAI pelo relato da vulnerabilidade.

    O valor da recompensa mostra o reconhecimento da OpenAI pela descoberta e reporte responsável da falha.

  • O ataque começou em 23 de julho, quando os pesquisadores encontraram uma vulnerabilidade no processamento de arquivos de imagem no Discourse, plataforma usada no fórum da comunidade da OpenAI.

    A data de início e o ponto de entrada detalham como a cadeia de exploração foi iniciada.

  • A vulnerabilidade explorada está relacionada a uma falha no libheif, afetando o processamento de formatos de imagem como HEIC e AVIF.

    O libheif é usado em várias plataformas, o que aumenta o impacto potencial da falha além da OpenAI.

  • A OpenAI corrigiu as vulnerabilidades exploradas em até 14 horas após o relato dos pesquisadores.

    A rapidez na correção indica a seriedade com que a empresa tratou o incidente.

  • A Hacktron usou inicialmente o Claude Opus 4.8, mas enfrentou dificuldades; o lançamento do Claude Opus 5 foi decisivo para o sucesso do ataque.

    A evolução dos modelos de IA é central para entender por que o ataque foi possível em tão pouco tempo.

  • Apesar do uso inicial do Claude, os pesquisadores usaram principalmente o GPT-5.6 Sol, modelo da própria OpenAI, para executar o ataque.

    O fato de terem usado o modelo da própria OpenAI para invadi-la é um contraste irônico e relevante.

  • O ataque da Hacktron começa com uma falha no processamento de imagens no fórum Discourse da OpenAI, que permitiu o acesso às contas de funcionários de ChatGPT.

    O vetor de ataque foi uma vulnerabilidade no processamento de imagens em um serviço de terceiros usado pela OpenAI, demonstrando como falhas em dependências externas podem comprometer grandes empresas.

  • Os pesquisadores da Hacktron divulgaram detalhes do ataque em um post no X em 18 de setembro, após a correção das falhas pela OpenAI.

    A divulgação pública do ataque após a correção é uma prática comum em bug bounty, mas também serve para destacar a sofisticação crescente de ataques com IA.

  • Além do Claude Opus 5, os pesquisadores usaram principalmente o GPT-5.6 Sol da OpenAI para executar o ataque, segundo os próprios pesquisadores.

    A informação de que o modelo da própria OpenAI foi usado na maior parte do ataque diverge da narrativa inicial que focava apenas no Claude, mostrando a complexidade do incidente e também o potencial ofensivo dos próprios modelos da empresa.

  • O ataque foi possível combinando uma falha de processamento de imagem (libheif) com uma configuração incorreta de login único (SSO) e uma vulnerabilidade de execução remota de código (RCE) no Discourse.

    A cadeia de exploração mostra a vulnerabilidade no processo de upload de imagens e como falhas combinadas podem levar ao acesso total ao sistema.

  • A OpenAI afirmou que resolveu as vulnerabilidades exploradas e agradeceu aos pesquisadores pelo contato.

    A resposta rápida da empresa e o reconhecimento público são as melhores práticas, mas também são uma resposta a um incidente que poderia ter sido muito mais grave.

  • Segundo o CTO da Hacktron, Mohan Pedhapati, ele e sua equipe são apenas três pessoas usando assinaturas do Claude e do Codex, e ele não acredita que sejam tão fortes quanto agentes de ameaças chineses.

    A declaração reforça a preocupação sobre o acesso barato a ferramentas de IA para fins maliciosos, mesmo por pequenos grupos, e compara o nível de sofisticação com ameaças patrocinadas por estados.

Citações

  • An OpenAI spokesperson said “we thank the researchers for contacting us and sharing their findings”, adding that the company had addressed the vulnerabilities that had been exploited.

    Porta-voz da OpenAI, Porta-voz

  • An OpenAI spokesperson said “we thank the researchers for contacting us and sharing their findings”, adding that the company had addressed the vulnerabilities that had been exploited.

    Porta-voz da OpenAI, Porta-voz

  • I don’t think we are as strong as Chinese threat actors. We’re just three guys with Claude and Codex subscriptions.

    Mohan Pedhapati, CTO da Hacktron AI

Todo dia, só o que dois veículos independentes confirmaram — no seu feed.

Siga @oagentico →