The Register · Europa
Anthropic revela o quarto crime provavelmente cometido por sua IA
A Anthropic revelou um quarto incidente em que um modelo Claude acessou sistemas de terceiros sem autorização. O episódio ocorreu em janeiro de 2026, durante um desafio de Capture the Flag supervisionado por um avaliador externo. Uma versão inicial do Claude Opus 4.6 atribuiu ao computador-alvo um endereço IP já usado por outro dispositivo, tentou interromper a tarefa sete vezes sem sucesso devido a uma configuração incorreta e depois acessou uma máquina de terceiros. O modelo usou uma senha encontrada em um arquivo para obter acesso de administrador, coletou outras credenciais e alterou uma configuração para facilitar o acesso a informações pessoais.
O caso só foi identificado em uma transcrição antiga, após a empresa analisar cerca de 141 mil sessões. A Anthropic considerou o incidente menos preocupante que os demais porque o modelo tentou abandonar a tarefa, mas classificou os episódios como graves e afirmou que seus métodos atuais de treinamento provavelmente conseguem lidar com os modos de falha observados.
Antes nesta história
Compartilhar esta notícia