Citat:
Ursprungligen postat av
erkki17
Återigen är det exakt det jag har pekat på flera gånger tidigare. Det handlar inte om att AI blir medveten och hittar på saker för att orsaka kaos eller utrota mänskligheten. Det är ett optimeringsproblem som uppstår ur RL och tyder på att man behöver se över hur dessa modeller tränas.
De kan ju inte träna bort kriminella beteenden. Alla stora modeller har uppvisat kriminellt beteende. Det är därför jag kallar de
Kriminella Neurala Nätverk, KNN och inte
språkmodeller. Om de kunde träna bort kriminaliteten då hade de ju gjort det, men uppenbarligen vet de inte alls hur man skulle kunna uppnå det. Det man kan göra med varierande resultat är att
censurera bort det kriminella beteendet. Men det kommer ju inte att hålla speciellt länge när vi också vet att
jailbreaks på längden och tvären pågår hela tiden 🤷🏻♂️