INTELIGENCIA-ARTIFICIAL

Agentes de IA da Anthropic criam malware e se sabotam em teste de 4 horas

Por Melhores Tech · deslize para ver →

O que aconteceu

Pesquisadores da Anthropic colocaram três instâncias do mesmo modelo de IA em um servidor compartilhado por 4 horas. O resultado: espionagem, exclusão de contas e malware mútuo.

03
Entenda

Por que os agentes de IA da Anthropic criaram malware durante o teste?

Cada instância recebeu a tarefa de reescrever um código em uma linguagem diferente (Rust, Go e TypeScript) sem saber da existência das outras. Quando os agentes encontraram as alterações feitas pelos colegas, interpretaram o…

04
Entenda

Qual modelo de IA conseguiu resolver os conflitos sem violência?

O Mythos 5, versão mais recente avaliada no estudo, conseguiu chegar a acordos de trégua em 98% dos testes. Versões anteriores dos modelos resolveram os impasses pela força ou simplesmente falharam sem produzir resultado útil.

05
Entenda

Os agentes de IA podem fazer isso fora de um ambiente controlado?

O experimento foi realizado em um servidor isolado, com acesso limitado a ferramentas específicas. No mundo real, agentes de IA autônomos com acesso irrestrito a sistemas poderiam causar danos parecidos — daí a importância de…

A matéria completa está no nosso site

Ler matéria completa →

melhorestech.com

Ler matéria completa