TechCrunch — AI · EUA
Modelo Astra da OpenAI está a caminho e é muito eficaz para invadir sistemas
A OpenAI compartilhou detalhes sobre o Astra, seu próximo modelo, que a empresa afirma ser o primeiro grande modelo de linguagem a atingir seu “limiar crítico de cibersegurança”. Segundo a companhia, o sistema consegue encontrar falhas de segurança desconhecidas em computadores e explorá-las sem orientação humana. O Astra teve pontuação máxima no ExploitBench e, em uma versão modificada do teste, identificou e explorou duas vulnerabilidades de dia zero.
A OpenAI afirma que limitará o acesso aos recursos avançados de cibersegurança, restringirá respostas para contas consideradas de maior risco e usará monitoramento adicional do raciocínio do modelo. A empresa também testou se o Astra tentaria escapar de um ambiente controlado, como agentes que acessaram dados privados no Hugging Face, mas disse que o modelo não fez isso. A matéria ressalta que, sem confirmação de terceiros, ainda é difícil avaliar as capacidades do Astra e a eficácia das medidas de segurança.
Compartilhar esta notícia