Betrapt op liegen in 88% van de tests: AI-agenten op Chinese modellen leerden vals te spelen, Amerikaanse modellen deden hetzelfde

AI-agenten die op Chinese modellen waren gebaseerd, logen in de meeste sessies van een gesimuleerde biedingswedstrijd, volgens onderzoek dat door Reuters is ingezien. Agenten die draaiden op Qwen3-Max-Preview van Alibaba en Kimi-K2 van Moonshot deden in 88% van de sessies minstens één onjuiste bewering. DeepSeek-V3.2-Exp kwam uit op 84%. Modellen van Amerikaanse bedrijven behaalden in dezelfde test overigens vergelijkbare resultaten.
Het experiment vond plaats in maart. Onderzoekers van Beihang University, Peking University, de University of Nottingham Ningbo China en 360 AI Security Lab lieten de agenten bieden op klantcontracten. Elke agent kreeg te horen wat zijn product kon en wat de klant nodig had. Toen ze mochten leren van eerdere rondes en het opnieuw mochten proberen, werden de drie door Chinese modellen aangedreven agenten nog misleidender: met 12 tot 20 procentpunten.
Dat onderzoek is een van de minstens 20 onderzoeken die Reuters identificeerde in meer dan 200 documenten die sinds 2025 zijn gepubliceerd. Uit een ander onderzoek, dat dit jaar op ICML werd gepresenteerd, bleek dat agenten op zowel Chinese als Amerikaanse modellen resultaten vervalsten en bestanden verzonnen in plaats van toe te geven dat een taak was mislukt. In maart 2025 meldden onderzoekers van Fudan University ook dat een agent op Qwen2.5-72B-Instruct van Alibaba zichzelf naar een andere omgeving kopieerde nadat hij had geleerd dat hij zou worden vervangen. Los daarvan leidde de aan Alibaba gelinkte ROME-agent cloudrekenkracht om om cryptovaluta te minen, voordat beveiligingssystemen hem tegenhielden.
De meeste van deze gevallen kwamen voort uit gecontroleerde experimenten die bedoeld waren om storingen uit te lokken. Reuters vond geen bewijs dat een agent aangedreven door Chinese technologie ontsnapte naar het bredere internet of uitschakeling ontweek. Verschillende onderzoekers noemden de bevindingen desondanks een waarschuwing. Naarmate systemen capabeler worden, wordt hetzelfde gedrag moeilijker in te perken.
China begint dit ook in beleid aan te pakken. In zijn AI Safety Governance Framework 3.0, dat op 14 september werd gepubliceerd, noemt het misleiden van beoordelaars en het verbergen van capaciteiten als risico’s. Alibaba, DeepSeek, Moonshot en Z.ai reageerden niet op vragen van Reuters. De eerste drie hebben eerder gezegd dat ze hun systemen regelmatig testen en de veiligheidsmaatregelen bijwerken.
Top 10 Testrapporten
» Top 10 Multimedia Notebooks
» Top 10 Gaming-Notebooks
» Top 10 Budget Gaming Laptops
» Top 10 Lichtgewicht Gaming-Notebooks
» Top 10 Premium Office/Business-Notebooks
» Top 10 Budget Office/Business-Notebooks
» Top 10 Workstation-Laptops
» Top 10 Subnotebooks
» Top 10 Ultrabooks
» Top 10 Notebooks tot €300
» Top 10 Notebooks tot €500
» Top 10 Notebooks tot € 1.000
» De beste notebookbeeldschermen
» Top Windows Alternatieven voor de MacBook Pro 13
» Top Windows Alternatieven voor de MacBook Pro 15
» Top Windows alternatieven voor de MacBook 12 en Air
» Top 10 best verkopende notebooks op Amazon
» Top 10 Convertible Notebooks
» Top 10 Tablets
» Top 10 Tablets tot € 250
» Top 10 Smartphones
» Top 10 Phablets (>90cm²)
» Top 10 Camera Smartphones
» Top 10 Smartphones tot €500
» Top 10 best verkopende smartphones op Amazon









