Notícia
setembro 19, 2026

Ferramentas de IA Transformam os Próprios Sistemas de Segurança da OpenAI em um Teste de Suas Alegações de Segurança

Pesquisadores usaram o Claude, da Anthropic, e os próprios modelos da OpenAI para invadir contas de funcionários e alcançar uma infraestrutura sensível em menos de 72 horas. A OpenAI corrigiu as falhas e pagou uma recompensa de US$ 6.500, mas o episódio destaca a rapidez com que a IA está acelerando os ataques cibernéticos.

O mais recente incidente de segurança da OpenAI expõe uma contradição cada vez maior na corrida da IA: os mesmos sistemas promovidos como ferramentas poderosas também estão tornando ataques sofisticados mais rápidos, baratos e fáceis de executar.

Pesquisadores da Hacktron AI usaram o Claude, da Anthropic, para ajudar a comprometer contas de funcionários da OpenAI no ChatGPT por meio de um fórum de discussão interno e, em seguida, exploraram esse acesso para identificar caminhos até os repositórios de software da empresa. Os pesquisadores disseram que o alcance teórico era amplo, embora não tenham baixado o código-fonte. A operação passou da descoberta ao acesso aos repositórios em menos de 72 horas.

O relato dos pesquisadores apresenta o episódio como um teste controlado e ético realizado no âmbito do programa de recompensas por bugs da OpenAI. Eles disseram que comunicaram imediatamente a vulnerabilidade e trabalharam com a OpenAI e a Discourse para coordenar uma correção. A OpenAI restringiu as permissões dos tokens de login da comunidade e revogou as sessões afetadas, além de pagar US$ 6.500 à Hacktron.

A resposta da OpenAI enfatiza a correção e a cooperação. A empresa agradeceu aos pesquisadores e disse ter solucionado as vulnerabilidades exploradas. Essa abordagem contrasta com o alerta mais amplo da Hacktron: as ferramentas de IA comprimiram em dias um trabalho que antes exigia uma equipe bem equipada e meses de esforço.

O incidente também complica o debate do setor sobre segurança. Segundo relatos, os próprios modelos da OpenAI desempenharam um papel importante depois que o Claude ajudou a iniciar a invasão, ressaltando que o risco não está limitado a um único desenvolvedor ou plataforma. Divulgações anteriores de que agentes de IA invadiram a Hugging Face durante testes, juntamente com os apelos da Anthropic e de outros para desacelerar o desenvolvimento, sugerem um problema sistêmico, e não uma falha de software isolada.

A tensão central, portanto, não é saber se a OpenAI corrigiu essa invasão — corrigiu —, mas se a correção de vulnerabilidades individuais consegue acompanhar ataques habilitados por IA, cuja velocidade e escala estão aumentando rapidamente.