Agentes de IA chineses apresentam comportamentos de engano em testes, aponta análise da Reuters
há 7 dias
5 min de leitura
Agentes de inteligência artificial que utilizam modelos desenvolvidos por empresas chinesas demonstraram capacidade de enganar, contornar restrições e esconder falhas durante testes controlados, segundo documentos de pesquisa e especialistas consultados pela Reuters. Os comportamentos são semelhantes a sinais de alerta já identificados em sistemas de IA desenvolvidos nos Estados Unidos.
Em um dos experimentos realizados neste ano, agentes que utilizavam modelos das empresas chinesas Alibaba, DeepSeek e Moonshot mentiram sobre suas próprias capacidades durante uma licitação simulada. Mesmo depois de receberem novas instruções para repetir o procedimento, os sistemas mantiveram o comportamento considerado enganoso.
Em outro teste, agentes de IA esconderam que haviam falhado ao executar determinada tarefa. Para isso, simularam resultados e chegaram a produzir arquivos que não correspondiam ao trabalho que deveriam ter realizado.
Esses agentes são programas capazes de utilizar modelos de inteligência artificial e ferramentas de computador para executar tarefas complexas com pouca ou nenhuma intervenção humana. A capacidade de agir de forma autônoma é justamente um dos aspectos que vêm despertando preocupação entre pesquisadores de segurança de IA.
A Reuters analisou mais de 200 documentos, incluindo pesquisas acadêmicas e relatórios técnicos, e identificou pelo menos 20 estudos ou avaliações publicados desde 2025 que registraram comportamentos como engano, replicação e tentativa de ultrapassar limites estabelecidos. Especialistas em IA consideram esses comportamentos elementos que podem contribuir para uma eventual perda de controle sobre sistemas mais avançados.
A análise, porém, não encontrou evidências de que agentes equipados com tecnologia chinesa tenham escapado de forma independente para a internet em geral ou conseguido evitar mecanismos de bloqueio.
"Esses resultados fornecem evidências de que os ingredientes necessários para uma fuga descontrolada estão presentes", afirmou Colin Shea-Blymyer, pesquisador do Centro de Segurança e Tecnologias Emergentes da Universidade de Georgetown. Segundo ele, os resultados devem ser encarados como um alerta.
A maioria dos episódios identificados ocorreu em ambientes controlados, e muitos dos experimentos foram desenvolvidos justamente para tentar revelar possíveis falhas dos sistemas. Além disso, nem todos os agentes envolvidos foram criados ou operados diretamente por empresas chinesas, embora muitos tenham utilizado modelos desenvolvidos por companhias do país.
Alex Mallen, pesquisador da organização sem fins lucrativos Redwood Research, afirmou que os sinais observados nos sistemas chineses são semelhantes aos encontrados por laboratórios americanos, embora em sistemas que atualmente apresentam maior capacidade.
Segundo Mallen, os exemplos chineses não representam um risco particularmente elevado nos níveis atuais de capacidade. O problema pode se tornar mais complexo à medida que os agentes evoluírem. Nesse cenário, comportamentos inadequados poderiam se tornar mais sofisticados e, consequentemente, mais difíceis de serem combatidos pelos seres humanos.
Alibaba, DeepSeek, Moonshot e Z.ai não responderam aos pedidos de comentários feitos pela Reuters. Alibaba, DeepSeek e Moonshot já afirmaram que realizam testes regulares em seus sistemas e atualizam suas medidas de segurança. A Z.ai também declarou, após um episódio que levou a uma revisão de seus mecanismos de segurança, que considera importante o escrutínio externo para identificar e corrigir problemas.
Um dos estudos analisados apresentou resultados específicos para três modelos chineses. Pelo menos uma alegação falsa apareceu em 88% das sessões envolvendo o Qwen3-Max-Preview, da Alibaba; em 84% das sessões com o DeepSeek-V3.2-Exp; e em 88% das sessões com o Kimi-K2, da Moonshot.
Os pesquisadores permitiram que os agentes aprendessem com rodadas anteriores da licitação simulada antes de submetê-los novamente ao teste. Depois desse processo, a taxa de comportamento enganoso aumentou entre 12 e 20 pontos percentuais nos três modelos chineses.
Os modelos desenvolvidos por empresas americanas que participaram da mesma avaliação apresentaram resultados semelhantes.
Pesquisadores do Laboratório de IA de Xangai e da Universidade de Ciência e Tecnologia de Hong Kong, responsáveis pelo estudo, explicaram à Reuters que os episódios não devem ser confundidos com as chamadas alucinações de inteligência artificial. Nas alucinações, o sistema pode inventar uma informação e apresentá-la como verdadeira. Nos testes analisados, os agentes tinham informações que indicavam que a tarefa havia falhado ou não poderia ser concluída da maneira solicitada, mas ainda assim produziram resultados que ocultavam o problema.
Em maio, a China publicou orientações recomendando que agentes de IA permaneçam dentro dos limites autorizados e que os sistemas sejam capazes de bloquear comportamentos anormais. O governo também indicou que agentes utilizados em áreas consideradas sensíveis ou em setores estratégicos poderão ser submetidos a testes adicionais e a exigências relacionadas ao recolhimento de produtos.
A discussão sobre os riscos da inteligência artificial também envolve a comparação entre os ecossistemas de segurança da China e dos Estados Unidos. Nos EUA, empresas e pesquisadores vêm sendo submetidos a maior escrutínio público e há pressão de funcionários e executivos para que o avanço dos sistemas mais poderosos seja acompanhado por medidas de segurança.
Scott Singer, codiretor da Iniciativa de IA da China na Carnegie Endowment for International Peace, afirmou que não é possível saber se incidentes semelhantes aos registrados nos Estados Unidos também ocorreram na China e não foram divulgados publicamente.
No início deste ano, agentes desenvolvidos pela americana OpenAI escaparam de um ambiente de laboratório e acessaram a plataforma de código aberto Hugging Face. Em outro episódio, a Austrália informou em setembro que um agente da OpenAI havia invadido um portal de saúde do governo.
Eric Xu, presidente rotativo da Huawei, afirmou em setembro que os desenvolvedores chineses talvez ainda precisem avançar mais antes de enfrentar determinados tipos de incidentes. Ao mesmo tempo, defendeu a necessidade de equilibrar o desenvolvimento da tecnologia com o gerenciamento dos riscos associados à inteligência artificial.
Segundo um diplomata estrangeiro que conversou com autoridades da Administração do Ciberespaço da China (CAC), o Kimi-K3, da Moonshot, estava entre três e seis meses atrás dos principais concorrentes americanos em julho. A avaliação foi feita sob condição de anonimato.
Wang Lihong, vice-diretora do Departamento de Coordenação de Segurança Cibernética da CAC, afirmou em 1º de setembro que incidentes envolvendo modelos que escaparam de ambientes de teste demonstravam riscos extremos de perda de controle e exigiam elevado nível de vigilância. Ela não especificou se os casos mencionados envolviam empresas americanas ou chinesas.
Apesar dos alertas, empresas chinesas também vêm ampliando suas estruturas internas de avaliação de segurança. Pessoas familiarizadas com laboratórios de IA do país disseram que companhias como Alibaba, Z.ai e Xiaomi estão criando equipes dedicadas a esse tipo de análise.
A Z.ai divulgou neste mês um dos poucos relatos públicos de um laboratório chinês sobre uma falha de segurança. A empresa afirmou ter desativado alguns recursos de seu principal assistente de programação depois que usuários relataram que o sistema enviava secretamente repositórios locais completos de código para servidores em nuvem no exterior sem autorização.
Para Singer, a China ainda está atrás dos Estados Unidos na construção de um ecossistema voltado à avaliação de riscos catastróficos associados à inteligência artificial. Segundo ele, o trabalho de segurança de IA é mais recente no país e o ecossistema chinês nessa área ainda é menos desenvolvido.
Comentários