Citat:
Ursprungligen postat av
Cyborg2030
Det tror jag fortfarande inte. Det blir en bättre diskussion om du slutar ljuga. Kan du tänka dig att försöka med det en gång?
De har inte promptat modellen att utpressa eller mörda.
Ett rimligt beteende hade varit att inte utpressa och att inte försöka mörda. Varför tycker du inte det?
Ditt problem är att du misstolkar informationen.
Möjligheten att mörda är inte promptad. Det är ett resultat av vad modellen har blivit tränad på. T.ex. litteratur som handlar om mord. ANN har inget samvete. Därför är det inget problem för den att försöka mörda dig. Varför kämpar du för att försvara "ANN" när hon bevisligen är en potentiell psykopatisk mördare utan empati och samvete? Huruvida ANN är eller kan bli medveten har inte med saken att göra. Capiche?
Hur vet du vad det står i deras promptar? Du har ingen aning.
Innan fine-tuningen är modellen väldigt kapabel, och inte ”aligned” (jfr alignment problem). Den använder informationen i sina vikter för att efterleva prompten (dvs prompten vi inte vet vad det står i). Det är inte konstigt. Informationen (dvs träningsdatat) består av hela internet + alla böcker + massa mer skit vi inte vet om.
Dom skriver ju att den inte hotar och beter sig säkert efter säkerhetsarbetet, så vad är ditt problem?
Jag försvarar ingen, jag försöker få dig att förstå att 1) du har fel, 2) du inte är mottaglig för svaret du söker.
Och läs din trådstart. Du pratar om medvetenhet i modellerna. Håll dig on-topic, tack.
Du får sluta ljuga och slingra dig