Segurança Cibernética
IA da Anthropic é usada para hackear sistema da OpenAI em teste de segurança
Startup encontrou vulnerabilidade no fórum de ajuda da OpenAI usando o modelo Claude Opus; falha foi corrigida em 14 horas e pesquisadores receberam recompensa
Uma equipe de pesquisadores da startup Hacktron AI conseguiu acessar contas do ChatGPT de funcionários da OpenAI utilizando modelos de inteligência artificial da concorrente Anthropic. O episódio ocorreu durante um exercício de segurança organizado pela própria OpenAI para identificar vulnerabilidades em seus sistemas.
A invasão foi realizada no âmbito de um programa que convida especialistas externos em segurança da informação a testarem as defesas da empresa. A OpenAI confirmou o incidente nesta sexta-feira (18).
Os pesquisadores identificaram uma brecha no fórum público de ajuda da OpenAI, hospedado na plataforma Discourse. A vulnerabilidade permitiu que tomassem controle do site e acessassem contas de usuários da empresa.
Continua depois da publicidade
Uso de modelos de IA no ataque
A equipe da Hacktron relatou ter utilizado inicialmente o Claude Opus 4.8, da Anthropic, para localizar e explorar a falha de segurança. Segundo os pesquisadores, esse modelo apresentou dificuldades para funcionar de maneira consistente durante o processo.
Em seguida, recorreram ao Claude Opus 5, versão mais recente do assistente de inteligência artificial. Com esse modelo, os hackers conseguiram produzir um ataque funcional em aproximadamente três horas.
Os pesquisadores não utilizaram o Claude Mythos, modelo mais avançado da Anthropic com capacidades aprimoradas de cibersegurança, que permanece restrito a um grupo limitado de organizações de defesa cibernética.
Resposta e correção
A Hacktron informou imediatamente a vulnerabilidade tanto à OpenAI quanto à Discourse, trabalhando em conjunto com as empresas para coordenar a solução do problema.
A falha foi corrigida em cerca de 14 horas após a notificação. Como reconhecimento pelo trabalho, a OpenAI pagou aos pesquisadores uma recompensa de US$ 6.500, equivalente a aproximadamente R$ 34 mil.
Drew Pusateri, porta-voz da OpenAI, agradeceu aos pesquisadores por compartilharem as descobertas e explicaram as medidas adotadas para resolver a questão.
Preocupação com segurança
O caso reforça a preocupação crescente entre especialistas em segurança cibernética sobre o potencial das ferramentas de inteligência artificial para facilitar ataques digitais. Atividades que antes demandavam equipes especializadas e meses de trabalho podem agora ser realizadas de forma mais rápida e com menor custo.
A Hacktron informou que continua realizando testes de segurança semelhantes em outras empresas.
Participe da conversa
Acesse sua conta Mancheck para comentar.
Entrar