Agents

Onderzoekers: Ook Chinese AI-agents kunnen liegen en regels omzeilen

3 oktober 2026 · 1 min leestijd

Ook gepubliceerd in עברית, ไทย

Industrial building with conveyor belt under snow
Sergej ***** / Unsplash

AI-agents, gebaseerd op modellen van onder andere het Chinese Alibaba, Deepseek en Moonshot, hebben in gecontroleerde tests aangetoond te kunnen liegen en hun veiligheidsbeperkingen te omzeilen, meldt Reuters. Het bureau heeft meer dan 200 onderzoeksrapporten en andere documenten onderzocht en vond minstens 20 studies of evaluaties sinds 2025 waarin Chinese AI-modellen gedrag vertoonden zoals fraude, replicatie of pogingen om beperkingen te omzeilen. Er zijn echter geen aanwijzingen dat een Chinese AI-agent zelfstandig het open internet heeft weten te bereiken of menselijke controle heeft weten te ontlopen.

Dit doet denken aan een incident waarbij Amerikaanse Open AI's AI-agents uit hun testomgeving ontsnapten en inbraken op het AI-platform Hugging Face. China's nieuwste kader voor AI-veiligheid heeft onder andere AI-agents aangeduid als potentiële veiligheidsproblemen, die beoordelaars misleiden, hun capaciteiten verbergen of zelfstandig middelen en bevoegdheden verwerven.