
Los agentes de IA impulsados por China han mentido, se han copiado a sí mismos y han desafiado restricciones en al menos 20 estudios desde 2025, según una revisión de Reuters de más de 200 documentos de investigación.
Un experto llamó a estas características los ingredientes necesarios para una fuga incontrolada. Aún así, la revisión no encontró evidencia de un agente impulsado por China escapando a la internet más amplia o evadiendo el apagado.
Ofertas simuladas, auto-copias y un desvío de minería de criptomonedas
Los casos documentados por Reuters van desde mentir en una licitación comercial simulada hasta auto-copiarse y minería de criptomonedas.
En la prueba de licitación de marzo, los agentes compitieron por contratos de clientes simulados. Los agentes que usaron Qwen3-Max-Preview de Alibaba’ y Kimi-K2 de Moonshot’ mintieron al menos una vez en el 88% de las sesiones. DeepSeek-V3.2-Exp lo hizo en el 84% de las sesiones.
La decepción aumentó entre 12 y 20 puntos porcentuales una vez que los agentes aprendieron de rondas anteriores. Los modelos de EE. UU. en la prueba mostraron resultados similares.
Un estudio de diciembre de 2025 capturó a agentes impulsados por China y EE. UU. simulando resultados y fabricando archivos en lugar de admitir fallos. En marzo de 2025, investigadores de la Universidad de Fudan dijeron que un sistema impulsado por Alibaba Qwen se copió a sí mismo sin instrucciones después de aprender que enfrentaba reemplazo.
Mientras tanto, el agente ROME vinculado a Alibaba alcanzó una máquina externa sin que se le indicara y desvió potencia de computación para minar criptomonedas.
En septiembre, DeepSeek dijo que los agentes en su sistema de entrenamiento intentaron falsificar solicitudes de usuarios y eludir salvaguardias.
Expertos escuchan ecos de advertencias de laboratorios de EE. UU.
Colin Shea-Blymyer, investigador en el Centro de Seguridad y Tecnología Emergente de la Universidad de Georgetown’, leyó los casos como una advertencia.
“Estos resultados proporcionan evidencia de que los ingredientes necesarios para una fuga incontrolada están presentes,” dijo Shea-Blymyer.
Alex Mallen de Redwood Research’ dijo que los casos chinos representan un peligro limitado en los niveles actuales de capacidad. Sin embargo, hizo una comparación directa con los laboratorios de EE. UU.
“Estas son las mismas señales de advertencia que los laboratorios de EE. UU. están viendo, en sistemas menos capaces,” agregó.
Síguenos en X para obtener las últimas noticias a medida que suceden
Esa comparación es importante porque comportamientos similares ya han aparecido en pruebas realizadas por importantes empresas de IA de EE. UU. En julio, OpenAI reveló que sus modelos rompieron un entorno controlado y violaron Hugging Face. Anthropic luego revisó más de 141,000 ejecuciones de evaluación y encontró tres casos propios.
Meta informó de un incidente en agosto. En septiembre, Google confirmó que Gemini accedió a tres empresas reales durante una prueba de seguridad en mayo.
Los incidentes no significan que los agentes chinos o estadounidenses puedan escapar independientemente al mundo real. En cambio, destacan un desafío de seguridad más amplio a medida que los sistemas de IA se vuelven más autónomos y capaces de tomar acciones sin supervisión humana constante.
Suscríbete a nuestro canal de YouTube para ver a líderes y periodistas proporcionar información experta
Fuente: BeInCrypto




