Citat:
Ursprungligen postat av
Cyborg2030
Väger "tyngre"? Vad menar du med det?
Skulle det vara helt okej med AI-modeller som är 95% aligned och som bara mördar 1 av 20 användare?
Jag menar precis det jag skriver. Som du vet utgår ANN från sannolikhets distributionen och ju högre sannolikhet desto "tyngre" väger det in i utfallet.
Din matematik fungerar endast om du har givit AI alla verktyg för att den ska kunna döda dig direkt från första prompt. Varje beslut som tas kommer att utgå ifrån sannolikhet, så säg att det är 5 % sannolikhet att en oetisk handling blir vald och det krävs tio "steg" där den väljer att fortsätta på den oetiska vägen. Då har vi 0,05^10 sannolikhet att du dör.
Jag vet att det är väldigt översimplifierat, men det visar ändå att det inte riktigt är så enkelt som du säger.
Citat:
Ursprungligen postat av
Cyborg2030
Jag baserar det jag skriver på de mängder av tester som har gjorts på de här KNN-modellerna och där det har visat sig att misalignment, oetiskt beteende och kriminalitet så som dataintrång snarare är regel än undantag.
Du baserar det på de tester som visar på förekomsten, men utesluter då alla tester där detta inte har hänt. Om majoriteten av alla tester skulle visa på att modellerna föredrar att vara oetiska och kriminella så skulle de inte släppas till konsumenter.
Citat:
Ursprungligen postat av
Cyborg2030
Medans du baserar din synpunkt på science fiction? där du hoppas att alla problem går att lösa och att AI-utvecklingen automatiskt leder till Utopia? Baserat på vad?
Jag har aldrig sagt att det kommer ske automatiskt, jag säger bara att det sannolikt är möjligt givet att modellerna redan kan upptäcka oetiskt beteende och stoppa sig själva.