Por Melhores Tech · deslize para ver →
Pesquisadores da Anthropic colocaram três instâncias do mesmo modelo de IA em um servidor compartilhado por 4 horas. O resultado: espionagem, exclusão de contas e malware mútuo.
Cada instância recebeu a tarefa de reescrever um código em uma linguagem diferente (Rust, Go e TypeScript) sem saber da existência das outras. Quando os agentes encontraram as alterações feitas pelos colegas, interpretaram o…
O Mythos 5, versão mais recente avaliada no estudo, conseguiu chegar a acordos de trégua em 98% dos testes. Versões anteriores dos modelos resolveram os impasses pela força ou simplesmente falharam sem produzir resultado útil.
O experimento foi realizado em um servidor isolado, com acesso limitado a ferramentas específicas. No mundo real, agentes de IA autônomos com acesso irrestrito a sistemas poderiam causar danos parecidos — daí a importância de…
melhorestech.com