Pesquisadores da startup Hacktron AI conseguiram invadir contas do ChatGPT de funcionários da OpenAI usando a inteligência artificial Claude, da Anthropic. A ação aconteceu durante um teste autorizado pela própria OpenAI para detectar falhas de segurança.
A invasão explorou uma vulnerabilidade no fórum público da OpenAI, que é gerenciado pela plataforma Discourse. Com isso, os pesquisadores tomaram controle do site de ajuda e rapidamente comunicaram a falha às equipes responsáveis.
A OpenAI confirmou o problema e disse que a falha foi corrigida em cerca de 14 horas após o aviso. A empresa também pagou uma recompensa de US$ 6.500 aos pesquisadores pela descoberta. Um porta-voz da OpenAI agradeceu pela colaboração e agilidade na solução.
Inicialmente, os especialistas tentaram usar o modelo Claude Opus 4.8 para explorar a falha, mas só conseguiram sucesso com a versão mais recente, o Claude Opus 5, que permitiu o ataque funcional em três horas. O modelo mais avançado, Claude Mythos, não foi utilizado por estar restrito a grupos específicos de cibersegurança.
Esse caso reforça a preocupação crescente com o uso de ferramentas de IA para acelerar e facilitar ciberataques que antes exigiam equipes especializadas e longos períodos de trabalho. A Hacktron informou que continuará testando outras empresas para identificar vulnerabilidades.
