Pesquisadores da Hacktron AI acessaram contas do ChatGPT vinculadas a funcionários da OpenAI durante um exercício de segurança autorizado pela empresa. Para realizar o teste, a equipe utilizou modelos de inteligência artificial da Anthropic, concorrente da OpenAI.
A vulnerabilidade estava no fórum público de ajuda da OpenAI, operado pela plataforma Discourse. A falha permitia assumir o controle do site e avançar na operação. A Hacktron AI comunicou o problema à OpenAI e à Discourse depois de concluir o teste.
A equipe usou diferentes modelos da Anthropic. O Claude Opus 4.8 foi empregado para identificar e explorar inicialmente a vulnerabilidade, mas apresentou dificuldades de consistência. Depois, os pesquisadores recorreram ao Claude Opus 5, que produziu um ataque funcional em cerca de três horas. O Claude Mythos não foi utilizado porque seu acesso é restrito a organizações selecionadas.
Correção e recompensa
A OpenAI confirmou o incidente e informou que corrigiu a vulnerabilidade cerca de 14 horas depois de receber a notificação. A empresa e a Discourse também trabalharam na coordenação da resposta ao incidente.
Por meio do programa de recompensas por identificação de bugs, a OpenAI pagou US$ 6.500 à Hacktron AI, valor equivalente a cerca de R$ 34 mil. Drew Pusateri, porta-voz da empresa, agradeceu aos pesquisadores pelo contato e pelo compartilhamento das descobertas.
O caso coloca em evidência o uso de inteligência artificial em operações de segurança ofensiva e a capacidade desses sistemas de acelerar a identificação e a exploração de vulnerabilidades. Também aumenta a preocupação de especialistas com a possibilidade de ciberataques sofisticados se tornarem mais rápidos e baratos.
A Hacktron AI informou que pretende continuar realizando testes de segurança semelhantes em outras empresas do setor.



