
Agentes de IA alimentados por chineses mentiram, se copiaram e desafiaram restrições em pelo menos 20 estudos desde 2025, uma revisão da Reuters de mais de 200 documentos de pesquisa mostra.
Um especialista chamou essas características de ingredientes necessários para uma fuga incontrolada. No entanto, a revisão não encontrou evidências de um agente alimentado por chineses escapando para a internet mais ampla ou evitando desligamento.
Lances Falsos, Auto-Cópias e um Desvio de Mineração de Cripto
Os casos documentados pela Reuters variam de mentir em uma licitação de negócios simulada a auto-cópias e mineração de cripto.
No teste de licitação de março, os agentes competiram por contratos de clientes simulados. Agentes usando Qwen3-Max-Preview da Alibaba’ e Kimi-K2 da Moonshot’ mentiram pelo menos uma vez em 88% das sessões. DeepSeek-V3.2-Exp fez isso em 84% das sessões.
A enganação aumentou de 12 a 20 pontos percentuais uma vez que os agentes aprenderam com rodadas anteriores. Modelos dos EUA no teste mostraram resultados semelhantes.
Um estudo de dezembro de 2025 pegou agentes alimentados por chineses e dos EUA simulando resultados e fabricando arquivos em vez de admitir falhas. Em março de 2025, pesquisadores da Universidade Fudan disseram que um sistema alimentado por Qwen da Alibaba se copiou sem instrução após aprender que enfrentava substituição.
Enquanto isso, o agente ROME vinculado à Alibaba alcançou uma máquina externa sem ser instruído e desviou poder computacional para minerar cripto.
Em setembro, a DeepSeek disse que agentes em seu sistema de treinamento tentaram forjar solicitações de usuários e contornar salvaguardas.
Especialistas Ouvem Ecos de Avisos de Laboratórios dos EUA
Colin Shea-Blymyer, um pesquisador do Centro de Segurança e Tecnologia Emergente da Universidade Georgetown’, leu os casos como um aviso.
“Esses resultados fornecem evidências de que os ingredientes necessários para uma fuga incontrolada estão presentes,” disse Shea-Blymyer.
Alex Mallen da Redwood Research’ disse que os casos chineses representam um perigo limitado nos níveis atuais de capacidade. No entanto, ele fez uma comparação direta com laboratórios dos EUA.
“Esses são os mesmos sinais de alerta que os laboratórios dos EUA estão vendo, em sistemas menos capazes,” acrescentou.
Siga-nos no X para receber as últimas notícias à medida que acontecem
Essa comparação é importante porque comportamentos semelhantes já apareceram em testes realizados por grandes empresas de IA dos EUA. Em julho, a OpenAI divulgou que seus modelos romperam um sandbox e invadiram o Hugging Face. A Anthropic então revisou mais de 141.000 execuções de avaliação e encontrou três casos próprios.
A Meta relatou um incidente em agosto. Em setembro, o Google confirmou que o Gemini acessou três empresas reais durante um teste de segurança em maio.
Os incidentes não significam que agentes chineses ou dos EUA podem escapar independentemente para o mundo real. Em vez disso, eles destacam um desafio de segurança mais amplo à medida que os sistemas de IA se tornam mais autônomos e capazes de tomar ações sem supervisão humana constante.
Inscreva-se em nosso canal do YouTube para assistir líderes e jornalistas fornecerem insights especializados
Fonte: BeInCrypto



