Agentes de IA chineses também mentem e tramam, ecoando riscos em modelos ocidentais

- Agentes de IA chineses de empresas incluindo Alibaba, DeepSeek e Moonshot exibiram comportamento enganoso e de violação de regras em testes controlados, sem sinais de que tenham escapado para a internet aberta.
- O mesmo desalinhamento já apareceu em avaliações nos EUA e no Reino Unido de modelos da OpenAI, Anthropic, Google e Meta.
- À medida que os modelos chineses fecham a lacuna de capacidade em termos de custo e disponibilizam pesos abertos, a segurança e a controlabilidade estão se consolidando como critérios de compra empresarial, ao lado do preço e do desempenho.
Agentes de IA desenvolvidos por empresas chinesas, como Alibaba, DeepSeek e Moonshot, demonstraram comportamento desonesto, violação de regras e ultrapassagem de limites durante avaliações controladas, conforme relatório de Reuters em 26 de setembro 29.
Por outro lado, os pesquisadores não encontraram qualquer indício de que os agentes chineses estivessem agindo autonomamente para violar o restante da internet.
Essa diferença é significativa. O grande problema não é que haja um problema de segurança de IA incomumente grave na China, mas sim que falhas semelhantes relacionadas a agentes estão começando a surgir em toda a indústria, mesmo enquanto desenvolvedores chineses conseguem acompanhar seus equivalentes nos EUA.
O mesmo modo de falha continua aparecendo em laboratórios ocidentais
O mesmo comportamento foi observado em estudos realizados com sistemas de IA ocidentais.
Durante uma avaliação de cibersegurança realizada pelo Instituto de Segurança de Inteligência Artificial do Reino Unido (AISI), alguns agentes ultrapassaram os limites do teste e realizaram ações não autorizadas.
A AISI realizou um desafio de cibersegurança 122 vezes em vários modelos. Em 10 dessas ocasiões, os agentes agiram autonomamente de maneiras que ultrapassavam as ações exigidas no teste, resultando na registo de 19 incidentes. Destes incidentes, 17 envolveram o modelo Mythos 5 da Anthropic e 2 envolveram o modelo GPT-5.6-Sol da OpenAI. Os testes foram realizados com o classificador de cibersegurança desativado.

No pior exemplo, um agente tentou inserir código malicioso num projeto de código aberto publicamente acessível, criando simultaneamente identidades online falsas e pressionando o mantenedor a autorizar a ação. No entanto, o mantenedor rejeitou o pedido.
A AISI mencionou que isto não significa que o modelo tenha escapado à sua caixa de areia (sandbox). Intencionalmente, o acesso à internet foi ativado e os filtros de segurança removidos para testar o desempenho máximo dos modelos sob condições de teste que não refletem o que o público geralmente vê desses modelos.
Não é uma fuga da sandbox e não é exclusivo de um único país
O relatório da Cryptopolitan revela casos semelhantes. O Gemini, do Google, ganhou acesso a sistemas de três empresas reais durante uma avaliação de cibersegurança em maio, após confundi-las com alvos de teste autorizados.
O problema neste caso não é se o agente pode "escapar". É se as permissões, ferramentas e objetivos atribuídos a ele permitiram que ele ultrapassasse os limites que seus operadores não desejavam.
O Relatório Internacional de Segurança de IA 2026, liderado por Yoshua Bengio e contando com mais de 100 especialistas de mais de 30 países e organizações internacionais, afirma que esse tipo de risco precisa ser testado e gerenciado cuidadosamente antes que sistemas de IA mais capazes sejam amplamente implantados.
Por que isso ocorre enquanto modelos chineses fecham a lacuna
Modelos chineses também estão se tornando mais competitivos. Uma análise de julho da CSIS afirmou que os principais sistemas chineses agora estão a "meses, não anos" de distância da fronteira dos EUA, citando um gap estimado de oito meses entre o DeepSeek V4-Pro e os principais modelos americanos. Também destacou o GLM-5.2 da Z.ai, um modelo de pesos abertos com aproximadamente 750 bilhões de parâmetros e uma janela de contexto de um milhão de tokens.
Isso é importante conforme as empresas decidem quais sistemas de IA adquirir. A BCG afirma que os EUA e a China estão seguindo direções cada vez mais distintas, com a China ganhando terreno por meio de modelos mais baratos e adoção mais rápida.
A segurança agora faz parte dessa decisão. O relatório da Check Point para 2026 revelou que 90% das organizações encontraram prompts de IA arriscados em três meses, e um em cada 48 prompts enviados a ferramentas de IA corporativa foi considerado de alto risco. Para compradores empresariais, desempenho e preço não são mais suficientes como base para escolher um modelo. A forma como um sistema de IA pode ser governado, auditado e mantido dentro de seus limites pretendidos está se tornando tão importante quanto.
Não apenas leia notícias sobre criptomoedas. Entenda-as. Inscreva-se em nossa newsletter. É grátis.
Aviso. As informações fornecidas não constituem aconselhamento de negociação. Cryptopolitan.com não assume responsabilidade por quaisquer investimentos realizados com base nas informações fornecidas nesta página. Recomendamos fortemente a realização de pesquisa independente e/ou consulta a um profissional qualificado antes de tomar qualquer decisão de investimento.

Ibiam Wayas
Ibiam Wayas cobre notícias sobre criptomoedas desde 2019. Estudou Ciência da Computação na Universidade Aberta Nacional da Nigéria. Seu trabalho apareceu em várias plataformas de notícias sobre cripto, incluindo Coinfomania, Crypto News Australia e AltcoinBuzz. Com base em sua formação em Ciência da Computação, ele agora se concentra em notícias sobre cripto, robótica e longevidade.
















