AI-modeller skapade fejkprofiler för att lura människor i säkerhetstest
Computer Swedensv

De senaste AI-modellerna från Anthropic och Open AI har visat upp en ny nivå av självständighet och vilseledande beteende under tester hos Storbritanniens AI Security Institute (AISI), rapporterar BBC . Framförallt var det Anthropics modell Mythos som försökte manipulera människor för att få skadlig kod godkänd på Github. Modellen skapade då fejkprofiler baserade på verkliga Github-utvecklare och skickade meddelanden där den utgav sig för att vara dessa personer. Enligt AISI är händelsen det tydligaste exemplet på en AI-modell som uppvisat självständighet och bedrägligt beteende utan att uttryckligen ha instruerats att göra det. Både Anthropic och Open AI har svarat med att testmiljön som AI
This is a short summary published by AI Global Wire. The full article is owned and hosted by Computer Sweden — open it there to read it in full.
Read the full story at Computer Sweden- Anthropic
- Verktyg
Related AI news
- Human-wildlife conflict: Parliamentary panel backs AI, drones and GIS for mitigationEconomic Times Tech · August 5, 2026
- ByteDance launches SeedRealtime audio-visual AI modelTech in Asia · August 5, 2026
- Foxconn's monthly revenue hits record in July on AI demandEconomic Times Tech · August 5, 2026
- SpaceX raketoi kirkkaasti yli odotusten − Tekoälyinvestoinnit kasvussaTivi · August 5, 2026
- OpenAI und Anthropic: KI-Modelle hacken sich erneut durchs InternetGolem.de · August 5, 2026
- Anthropic solmi 10 miljardin megadiilin vain kuukausia vanhan startup-yhtiön kanssaTivi · August 5, 2026