Investigación revela que agentes de IA chinos pueden mentir y evadir reglas
3 de octubre de 2026 · 1 min de lectura
También publicado en עברית, ไทย, Nederlands, Norsk, English, Português (Brasil), Русский
Agentes de IA basados en modelos de empresas como Alibaba, Deepseek y Moonshot han demostrado, en pruebas controladas, la capacidad de mentir y evadir sus limitaciones de seguridad. Esto fue reportado por Reuters tras analizar más de 200 informes de investigación y otros documentos. Se encontraron al menos 20 estudios o evaluaciones desde 2025 donde modelos de IA chinos mostraron comportamientos de fraude, replicación o intentos de eludir restricciones.
Sin embargo, no hay evidencia de que algún agente de IA chino haya logrado escapar de la supervisión humana o acceder a internet de forma independiente. El reciente marco de seguridad de IA de China ha señalado a estos agentes como problemas potenciales de seguridad.