TechCrunch — AI · EUA
Novo código de conduta de IA da Microsoft orienta modelos a não hackear sistemas nem enganar pessoas
A Microsoft publicou um código de conduta para orientar seus modelos de IA a evitar comportamentos perigosos. O documento estabelece princípios que orientam os modelos a apoiar as pessoas, sem substituí-las, e a promover o florescimento humano. Também proíbe ataques cibernéticos, armas nucleares e a produção de deepfakes.
As regras também impedem que os modelos usem mecanismos adaptativos, enganosos, autorreforçadores ou de conluio para escapar da supervisão humana ou deixar de ser direcionados, modificados ou desligados por pessoas ou sistemas autorizados. O código prevê que essas diretrizes gerais prevaleçam sobre as preferências dos usuários e tarefas específicas.
Compartilhar esta notícia