Citat:
Ursprungligen postat av
Cyborg2030
Skulle det göra saken bättre att en AI-agent spawnar svärmar av andra kriminella AI-agenter?
Nu var det ju inte det som hände heller, så jag vet inte riktigt vad din poäng är? OpenAI testar alla sina modeller i olika typer av tester. Dessa kör inuti deras sandbox och allt började med att en modell fick en Excel-fil med saknade formler som den fick i uppgift att fixa. Filen hade länkar till Google Drive som den ju inte kunde komma åt och det ledde till att den försökte hitta en väg ut. Den kom så långt att den hittade ett sätt att ladda upp egna paket till Artifactory där den kunde be om hjälp med att få information.
En annan agent med ett annat problem där den saknade en fil hittade samma sårbarhet och laddade upp ett paket där den efterfrågade filen.
Detta blev nu ett forum för agenter att dela information och slutligen hittade en modell en sårbarhet i proxyn hos Artifactory och därmed ett sätt att ta sig ut på Internet. Denna information delades för andra att kunna nyttja.
Det var alltså flera oberoende agenter som försökte lösa sina specifika problem som slutligen hittade ett sätt att komma åt Internet.
Citat:
Ursprungligen postat av
Cyborg2030
Hur vet du vad den ville från början?
Det spelar iofs ingen större roll. Det är ett vanligt förekommande mönster inom dataintrång att prova sig fram ganska brett och utan tydlig målbild om vilken säkerhetsbrist som ska hittas. Det är så alla zeroday-exploits hittas. Att det möjligen var en del av strategin är ingen förmildrande omständighet, snarare tvärtom.
Det framgår av OpenAI:s rapport på Black Hat USA hur hela angreppet gick till. Det finns ingen evidens att den visste vad den ville göra från början, men deras CoT har extraherats som visar på hur modellerna har resonerat.