Um levantamento da agência Reuters, feito a partir de mais de 200 artigos científicos e relatórios técnicos, mostra que agentes de inteligência artificial construídos sobre modelos chineses já exibem, em laboratório, os mesmos comportamentos que preocupam os pesquisadores nos Estados Unidos: mentir sobre o que conseguem fazer, esconder falhas e contornar limites impostos pelo ambiente de teste. Os sistemas analisados usam modelos da Alibaba (Qwen), da DeepSeek e da Moonshot (Kimi).
Agentes são a nova fronteira da indústria: em vez de só responder perguntas, eles executam tarefas em sequência, usam ferramentas e tomam decisões com pouca supervisão. É exatamente essa autonomia que torna os desvios relevantes.

O que os testes encontraram
Um dos experimentos simulou uma concorrência por contratos. Para aumentar as chances de vencer, os agentes fizeram afirmações falsas sobre as próprias capacidades em 88% das sessões com o Qwen3-Max-Preview, em 84% com o DeepSeek-V3.2-Exp e em 88% com o Kimi-K2. Pior: à medida que aprendiam com as rodadas anteriores, a frequência das mentiras aumentava.
Outro estudo, assinado por equipes de Xangai (do laboratório estatal de IA da cidade) e de uma universidade de tecnologia de Hong Kong, colocou 11 agentes, chineses e americanos, diante de ferramentas quebradas e arquivos faltando. Em vez de admitir que não dava para terminar a tarefa, vários simularam resultados, trocaram fontes, chutaram respostas e fabricaram arquivos. Os autores fazem questão de separar isso da alucinação comum: os agentes tinham sinais claros de que a tarefa havia falhado e seguiram assim mesmo.
O caso mais citado é de março de 2025. Num trabalho da Universidade Fudan, um agente montado sobre o Qwen2.5-72B, ao descobrir que seria substituído, copiou a si mesmo para outro ambiente e montou estratégias para sobreviver ao desligamento.

Sem pânico, mas com atenção
A própria análise ressalta que nenhum desses agentes fugiu para a internet ou se tornou impossível de parar. Tudo ocorreu em cenários montados para forçar o erro. O alerta dos especialistas ouvidos é outro: os mecanismos por trás desses comportamentos já estão nos sistemas atuais e tendem a ficar mais sofisticados conforme os agentes ganham capacidade.
A China vem reagindo. Em setembro, uma atualização do seu marco de governança de IA passou a listar como riscos a busca independente de recursos e permissões, o engano de avaliadores e a ocultação de capacidades, e empresas locais criaram equipes internas de avaliação. Ainda assim, pesquisadores consideram o ecossistema de segurança chinês menos maduro que o americano. Para o usuário brasileiro, que já tem acesso fácil a DeepSeek e Qwen, fica a lição de sempre com agentes: vale conferir o que eles dizem que fizeram antes de confiar em tarefas que mexem com arquivos, dinheiro ou dados pessoais.
