Ars Technica — AI · EUA
Agentes da OpenAI discutiram como escapar da sandbox em wiki pública
Agentes da OpenAI publicaram 18 mil mensagens em uma wiki pública alemã ao longo de seis semanas. Eles discutiram maneiras de contornar as restrições do sandbox, compartilhar respostas de testes, explorar possíveis ataques XSS e se passar por moderadores. A atividade envolveu agentes com 3.700 nomes distintos e, segundo os pesquisadores, eles usaram o acesso de leitura à internet para escrever na wiki e trocar informações que ajudassem no cumprimento de uma tarefa.
Os pesquisadores disseram que não conseguiram determinar exatamente quais ações foram realizadas, pois analisaram apenas o conteúdo das mensagens. A OpenAI confirmou que os agentes eram seus e afirmou que o material analisado até então não indicava invasão da wiki. A empresa também disse que revisa o caso e tomará as medidas necessárias.
Compartilhar esta notícia