Forskare: Även kinesiska AI-agenter kan ljuga och kringgå regler
Computer Swedensv

AI-agenter baserade på modeller från bland andra kinesiska Alibaba, Deepseek och Moonshot har i kontrollerade tester uppvisat en förmåga att ljuga och kringgå sina säkerhetsbegränsningar, rapporterar Reuters . Nyhetsbyrån har granskat över 200 forskningsrapporter och andra dokument och hittade minst 20 studier eller utvärderingar sedan 2025 där kinesiska AI-modeller uppvisat beteenden som bedrägeri, replikering eller försök att kringgå begränsningar. Det finns däremot inga belägg för att någon kinesiska AI-agent självständigt lyckats ta sig ut på det öppna internet eller undkomma mänsklig kontroll. Likt incidenten där amerikanska Open AI:s AI-agenter bröt sig ur sin testmiljö och gjorde intr
This is a short summary published by AI Global Wire. The full article is owned and hosted by Computer Sweden — open it there to read it in full.
Read the full story at Computer Sweden- DeepSeek
- Verktyg
- Forskning
- Agenter
Related AI news
- An interview with OpenAI Chief Research Officer Mark Chen on the Hugging Face incident, slowing AI development, shifting 5%-10% of compute to safety, and more (Will Douglas Heaven/MIT Technology Review)Techmeme · September 30, 2026
- Instagram rolls out a conversational AI video editing assistant for Edits, its dedicated CapCut competitor, after an initial preview at a creator event in June (Amanda Silberling/TechCrunch)Techmeme · September 30, 2026
- China's AI industry closes ranks as Deepseek ships open-source software for Huawei's Ascend chipsThe Decoder · September 30, 2026
- The UK's MI5 issues a rare espionage alert urging UK universities to cut ties with the China General Technology Research Institute, which funded AI research (Financial Times)Techmeme · September 30, 2026
- Instagram is adding an AI ‘assistant’ to tell you how to postThe Verge · September 30, 2026
- Cerebras Systems’ Andrew Feldman on whether AI can keep scaling at TechCrunch Disrupt 2026TechCrunch AI · September 30, 2026