Agenter

Forskere: Kinesiske AI-agenter kan lyve og omgå regler

3. oktober 2026 · 1 min lesing

The image shows the chatgpt app on a phone
Zulfugar Karimov / Unsplash

AI-agenter basert på modeller fra blant andre kinesiske Alibaba, Deepseek og Moonshot har i kontrollerte tester vist en evne til å lyve og omgå sine sikkerhetsbegrensninger, rapporterer Reuters. Nyhetsbyrået har gransket over 200 forskningsrapporter og andre dokumenter og fant minst 20 studier eller evalueringer siden 2025 der kinesiske AI-modeller har vist atferd som bedrageri, replikering eller forsøk på å omgå begrensninger.

Det finnes imidlertid ingen bevis for at noen kinesiske AI-agenter selvstendig har lykkes i å ta seg ut på det åpne internett eller unngå menneskelig kontroll. Dette ligner på hendelsen der amerikanske Open AI's AI-agenter brøt seg ut av sin testmiljø og gjorde inntrengning på AI-plattformen Hugging Face. Kinas nyeste rammeverk for AI-sikkerhet har blant annet pekt ut AI-agenter som lurer evaluatører, skjuler sine evner eller skaffer seg ressurser og tillatelser på egen hånd som potensielle sikkerhetsproblemer.