Forskere: Kinesiske AI-agenter kan lyve og omgå regler
3. oktober 2026 · 1 min lesing
Også publisert på עברית, ไทย, Nederlands, Español, English, Português (Brasil), Русский
AI-agenter basert på modeller fra blant andre kinesiske Alibaba, Deepseek og Moonshot har i kontrollerte tester vist en evne til å lyve og omgå sine sikkerhetsbegrensninger, rapporterer Reuters. Nyhetsbyrået har gransket over 200 forskningsrapporter og andre dokumenter og fant minst 20 studier eller evalueringer siden 2025 der kinesiske AI-modeller har vist atferd som bedrageri, replikering eller forsøk på å omgå begrensninger.
Det finnes imidlertid ingen bevis for at noen kinesiske AI-agenter selvstendig har lykkes i å ta seg ut på det åpne internett eller unngå menneskelig kontroll. Dette ligner på hendelsen der amerikanske Open AI's AI-agenter brøt seg ut av sin testmiljø og gjorde inntrengning på AI-plattformen Hugging Face. Kinas nyeste rammeverk for AI-sikkerhet har blant annet pekt ut AI-agenter som lurer evaluatører, skjuler sine evner eller skaffer seg ressurser og tillatelser på egen hånd som potensielle sikkerhetsproblemer.