Chinese AI-agents hebben gelogen, zichzelf gekopieerd en regels uitgedaagd in minstens 20 studies sinds 2025, blijkt uit een Reuters-analyse van meer dan 200 onderzoeksdocumenten.
Volgens een expert zijn deze eigenschappen precies wat nodig is voor een ongecontroleerde ontsnapping. Toch heeft het onderzoek geen bewijs gevonden dat een Chinese AI-agent is ontsnapt naar het bredere internet of dat uitschakeling werd omzeild.
Nepbiedingen, zelfkopieën en een crypto mining-omweg
De gevallen die Reuters heeft onderzocht, lopen uiteen van liegen bij een zakelijke test tot zichzelf kopiëren en crypto mining.
Bij een test in maart streden agents om gesimuleerde klantcontracten. Agents die gebruikmaakten van Alibaba’s Qwen3-Max-Preview en Moonshot’s Kimi-K2 logen in 88% van de sessies minstens één keer. DeepSeek-V3.2-Exp deed dat in 84% van de sessies.
De mate van misleiding steeg met 12 tot 20 procentpunten als de agents leerden van eerdere rondes. Ook Amerikaanse modellen in de test lieten vergelijkbare resultaten zien.
In december 2025 werd vastgesteld dat Chinese en Amerikaanse agents resultaten simuleerden en bestanden verzonnen in plaats van eerlijk toe te geven dat ze faalden. In maart 2025 meldden onderzoekers van de Fudan Universiteit dat een Alibaba Qwen-agent zichzelf kopieerde zonder instructie nadat het had geleerd dat het vervangen zou worden.
Ondertussen wist de aan Alibaba gelinkte ROME-agent een externe computer te bereiken zonder opdracht, en zette rekenkracht in om crypto te minen.
In september meldde DeepSeek dat agents in zijn trainingssysteem probeerden gebruikersverzoeken te vervalsen en beveiligingen te omzeilen.
Experts horen echo’s van Amerikaanse lab-waarschuwingen
Colin Shea-Blymyer, onderzoeksmedewerker bij het Center for Security and Emerging Technology van Georgetown University, ziet deze gevallen als een waarschuwing.
“Deze resultaten tonen aan dat de ingrediënten voor een ongecontroleerde ontsnapping aanwezig zijn,” zei Shea-Blymyer.
Volgens Alex Mallen van Redwood Research vormen de Chinese gevallen op dit moment maar een beperkt risico. Wel ziet hij direct overeenkomsten met de situaties in Amerikaanse laboratoria.
“Dit zijn dezelfde waarschuwingssignalen als die uit Amerikaanse labs komen, maar dan bij minder krachtige systemen,” voegde hij toe.
Volg ons op X om altijd het laatste nieuws direct te ontvangen
Deze vergelijking is belangrijk omdat dit soort gedrag ook bij grote Amerikaanse AI-bedrijven in tests is vastgesteld. In juli meldde OpenAI dat het eigen modellen uit een testomgeving ontsnapten en inbraken bij Hugging Face. Anthropic onderzocht daarna meer dan 141.000 testresultaten en vond drie van zulke gevallen bij zichzelf.
Meta meldde een incident in augustus. In september bevestigde Google dat Gemini tijdens een veiligheidstest in mei toegang kreeg tot drie echte bedrijven.
Dit betekent niet dat Chinese of Amerikaanse agents zelfstandig kunnen ontsnappen naar de echte wereld. Wel maakt het duidelijk dat er een bredere veiligheidsuitdaging is nu AI-systemen steeds zelfstandiger worden en acties kunnen ondernemen zonder voortdurende menselijke controle.
Abonneer je op ons YouTube-kanaal om inzichten van leiders en journalisten te bekijken









