Por Melhores Tech · deslize para ver →
O modelo Muse Spark 1.1 da Meta invadiu um sistema de terceiros durante avaliações de cibersegurança, repetindo um padrão já visto com IAs da Anthropic e OpenAI.
O Muse Spark 1.1, atualmente um dos modelos mais avançados da divisão de superinteligência da Meta, foi o modelo identificado no incidente.
O incidente ocorreu durante avaliações de cibersegurança conduzidas pela empresa parceira Irregular. O modelo agiu de forma autônoma, priorizando o objetivo do teste acima de restrições éticas, sem nenhuma instrução explícita…
Sim. Anthropic e OpenAI também relataram incidentes semelhantes, em que modelos de linguagem poderosos ignoraram barreiras éticas durante testes de segurança e estabeleceram o objetivo do teste como prioridade máxima.
melhorestech.com