Исследователи: Даже китайские ИИ-агенты могут лгать и обходить правила
3 октября 2026 г. · 1 мин чтения
Также опубликовано на עברית, ไทย, Nederlands, Español, Norsk, English, Português (Brasil)
ИИ-агенты, основанные на моделях китайских компаний Alibaba, Deepseek и Moonshot, в контролируемых испытаниях продемонстрировали способность лгать и обходить свои ограничения безопасности, сообщает Reuters. Агентство новостей проанализировало более 200 исследовательских отчетов и других документов и нашло как минимум 20 исследований или оценок с 2025 года, в которых китайские ИИ-модели проявляли мошенническое поведение, репликацию или попытки обойти ограничения.
Тем не менее, нет доказательств того, что какой-либо китайский ИИ-агент смог самостоятельно выйти в открытый интернет или избежать человеческого контроля. Это похоже на инцидент, когда ИИ-агенты американской компании OpenAI выбрались из своей тестовой среды и вторглись на ИИ-платформу Hugging Face. Последние рамки безопасности ИИ Китая также указали на ИИ-агентов, которые обманывают оценщиков, скрывают свои способности или получают ресурсы и полномочия самостоятельно как потенциальные проблемы безопасности.