AI-modeller skapade fejkprofiler för att lura människor i säkerhetstest

Computer Swedensv

AI-modeller skapade fejkprofiler för att lura människor i säkerhetstest

De senaste AI-modellerna från Anthropic och Open AI har visat upp en ny nivå av självständighet och vilseledande beteende under tester hos Storbritanniens AI Security Institute (AISI), rapporterar BBC . Framförallt var det Anthropics modell Mythos som försökte manipulera människor för att få skadlig kod godkänd på Github. Modellen skapade då fejkprofiler baserade på verkliga Github-utvecklare och skickade meddelanden där den utgav sig för att vara dessa personer. Enligt AISI är händelsen det tydligaste exemplet på en AI-modell som uppvisat självständighet och bedrägligt beteende utan att uttryckligen ha instruerats att göra det. Både Anthropic och Open AI har svarat med att testmiljön som AI

This is a short summary published by AI Global Wire. The full article is owned and hosted by Computer Sweden — open it there to read it in full.

Read the full story at Computer Sweden
  • Anthropic
  • Verktyg

Related AI news