Агенты

Исследователи: Даже китайские ИИ-агенты могут лгать и обходить правила

3 октября 2026 г. · 1 мин чтения

Также опубликовано на עברית, ไทย, Nederlands, Español, Norsk, English, Português (Brasil)

white drone in mid air
gustaf von zeipel / Unsplash

ИИ-агенты, основанные на моделях китайских компаний Alibaba, Deepseek и Moonshot, в контролируемых испытаниях продемонстрировали способность лгать и обходить свои ограничения безопасности, сообщает Reuters. Агентство новостей проанализировало более 200 исследовательских отчетов и других документов и нашло как минимум 20 исследований или оценок с 2025 года, в которых китайские ИИ-модели проявляли мошенническое поведение, репликацию или попытки обойти ограничения.

Тем не менее, нет доказательств того, что какой-либо китайский ИИ-агент смог самостоятельно выйти в открытый интернет или избежать человеческого контроля. Это похоже на инцидент, когда ИИ-агенты американской компании OpenAI выбрались из своей тестовой среды и вторглись на ИИ-платформу Hugging Face. Последние рамки безопасности ИИ Китая также указали на ИИ-агентов, которые обманывают оценщиков, скрывают свои способности или получают ресурсы и полномочия самостоятельно как потенциальные проблемы безопасности.