The
Insider
Tech

Anthropic ajudou a invadir a OpenAI — e a OpenAI pediu

Pesquisadores usaram o modelo Claude para acessar contas internas do ChatGPT num teste de segurança autorizado pela própria empresa.

19/09/2026 12:30 · leitura de 4 min

A startup Hacktron AI acessou contas de funcionários da OpenAI usando o modelo de linguagem Claude, da Anthropic, concorrente direta da empresa-alvo. A invasão foi confirmada pela OpenAI à agência AFP nesta sexta-feira (18) e ocorreu dentro de um exercício de segurança ofensiva contratado pela própria companhia para mapear brechas em seus sistemas.

A prática, conhecida no setor como red teaming, consiste em recrutar especialistas externos para atacar a infraestrutura de uma empresa antes que agentes mal-intencionados o façam. O detalhe incomum aqui é a ferramenta escolhida: um modelo de IA rival, da Anthropic, operando como vetor do ataque contra sistemas da OpenAI.

A Hacktron AI divulgou os detalhes da operação em seu site na mesma data. Não ficou claro quais dados foram acessados durante o exercício nem se as vulnerabilidades identificadas já foram corrigidas. A OpenAI não detalhou o escopo do teste além da confirmação à AFP.

O episódio expõe uma camada de complexidade que o debate sobre segurança em IA raramente toca: modelos avançados de linguagem podem ser instrumentalizados como ferramentas de ataque, inclusive contra outras empresas do setor. O fato de o ataque ter sido bem-sucedido — mesmo em ambiente controlado — sinaliza que as fronteiras entre capacidade técnica e risco operacional nesse mercado ainda estão sendo mapeadas.

A OpenAI não respondeu a pedidos de comentário adicionais até o fechamento desta matéria.