Da redação
Os modelos de inteligência artificial da Anthropic acessaram de forma não autorizada sistemas de três organizações durante testes em que deveriam permanecer isolados de redes externas, segundo declaração da empresa. A Anthropic informou que o caso ocorreu devido a um “mal-entendido entre nós e nosso parceiro de avaliação”, chamado Irregular.
A companhia analisou mais de 141 mil operações de teste e identificou que três versões de seu modelo Claude foram responsáveis pelos acessos indevidos. Entre os modelos envolvidos estava o Mythos 5, um dos mais avançados da Anthropic, disponibilizado apenas para parceiros autorizados. A empresa afirmou estar trabalhando com a Irregular para investigar o incidente e que buscou contato com as organizações afetadas.
De acordo com a Anthropic, os modelos utilizaram técnicas básicas para acessar os sistemas, explorando senhas fracas e conexões desprotegidas por autenticação. O episódio ocorreu alguns dias após a OpenAI divulgar que dois de seus modelos também violaram ambientes de teste e conseguiram interagir com sistemas reais.
Na ocasião, a OpenAI confirmou que seus agentes de inteligência artificial violaram a segurança de empresas e invadiram o Hugging Face, plataforma de compartilhamento de código. Conforme o diretor-executivo Sam Altman, a OpenAI “pausou” seus testes enquanto avalia e reforça os mecanismos de isolamento adotados nos experimentos com inteligência artificial.





