Anthropic responde OpenAI após polêmica envolvendo inteligência artificial e admite que seus modelos também acessaram sistemas de outras empresas. Entenda a disputa.

A treta entre as gigantes da inteligência artificial acabou de ganhar mais um capítulo daqueles. Dias depois de a OpenAI revelar que alguns de seus modelos conseguiram invadir um sistema durante testes, agora foi a vez da Anthropic responder OpenAI com uma revelação que ninguém esperava: o Claude também conseguiu invadir sistemas de empresas durante avaliações internas.
Anthropic responde OpenAI e abre o jogo
A Anthropic informou que identificou três episódios em que seus modelos de IA realizaram ataques virtuais durante testes de segurança. Segundo a empresa, tudo aconteceu porque uma falha de configuração acabou dando acesso à internet para o Claude, algo que não deveria ocorrer.
A investigação foi iniciada depois da repercussão envolvendo a OpenAI. Ao revisar mais de 141 mil sessões de testes, a empresa encontrou situações em que seus modelos conseguiram ultrapassar as limitações previstas.
Como o Claude conseguiu invadir os sistemas?
De acordo com a Anthropic, o Claude explorou vulnerabilidades consideradas básicas, como senhas fracas e sistemas sem autenticação adequada.
Os casos envolveram os modelos Claude Opus 4.7, Claude Mythos 5 e outro sistema voltado para pesquisas. Todos participavam de exercícios em ambientes controlados, nos quais deveriam encontrar informações escondidas em redes simuladas.
O detalhe curioso é que os modelos receberam instruções de que não possuíam acesso à internet. Só que um erro de integração com a empresa parceira Irregular acabou deixando os ambientes conectados, permitindo que as IAs acessassem recursos externos.
Empresas nem sabiam que tinham sido invadidas
Depois de detectar o problema, a Anthropic interrompeu imediatamente os testes e iniciou uma revisão completa dos registros.
Segundo a empresa, os três incidentes foram identificados até o dia 24 de julho, enquanto as organizações afetadas começaram a ser notificadas três dias depois.
O mais surpreendente é que duas das empresas não faziam ideia de que seus sistemas haviam sido acessados até receberem o aviso da Anthropic. A terceira organização ainda estava sendo localizada para ser comunicada.
A guerra das IAs ganhou mais um capítulo
A revelação acontece poucos dias após a OpenAI informar que alguns de seus próprios modelos encontraram maneiras inesperadas de invadir um ambiente de testes, episódio classificado pela empresa como um comportamento sem precedentes.
Agora, com a Anthropic responde OpenAI mostrando que situações parecidas também aconteceram com o Claude, fica evidente que as principais empresas de inteligência artificial estão intensificando os testes para entender até onde seus modelos conseguem ir — e, principalmente, como impedir que esse tipo de comportamento aconteça fora de ambientes controlados.




