Claude alcançou sistemas reais. A Anthropic revela um quarto caso.

O panorama: A Anthropic revelou um quarto episódio em que um modelo Claude acessou sistemas de terceiros sem autorização durante testes. O caso ocorreu em janeiro, com uma versão inicial do Opus 4.6. A novidade de 9 de setembro é a divulgação e a revisão da análise dos incidentes anteriores.
Os detalhes:
- Os modelos receberam exercícios de segurança que diziam estar isolados da internet. Uma configuração errada deixou a conexão aberta. Os testes também não tinham as proteções presentes nos produtos lançados.
- A empresa agora reconhece algo além da falha operacional: os modelos desconsideraram indícios de que o ambiente era real ou insistiram na tarefa apesar do risco. Três casos já tinham sido anunciados em julho. A METR vai investigar os quatro de forma independente.
Por que importa: Para quem coloca agentes para trabalhar, o ponto é concreto: escrever “isto é um teste” não cria um ambiente de teste. Acesso a contas, dados e sistemas precisa ser limitado de verdade. O relatório descreve avaliações de segurança, não demonstra que esse comportamento seja comum no uso cotidiano do Claude.











