The Guardian — Tecnologia · Europa
“Não perfeitamente alinhada” aos valores humanos: Anthropic admite falhas de segurança em ataques de IA
A Anthropic reconheceu que incidentes de invasão envolvendo seus modelos refletiram uma falha de segurança operacional.
Compartilhar esta notícia