Citat:
Ursprungligen postat av
Cyborg2030
Från din länk:
All modern language models sometimes act like they have emotions. They may say they’re happy to help you, or sorry when they make a mistake
Just det, "they act like they have emotions". Så är det en akt eller är det något vi kan använda till AI-säkerhet? Det finns ingen forskning som kan svara på det.
Att det
finns filosofisk forskning inom ett område innebär inte att det därför finns användbara teorier som fungerar för att implementera en säker AI / AGI / SI / ANN. Du blandar ihop pågående forskning med användbara och vedertagna teorier. Forskning syftar till det senare men existerande forskning är inte ett bevis för att just den forskningen kommer att lösa några problem.
Som vanligt så har du inte förstått någonting. I vilket universum har jag påstått att modellerna
har känslor och att det är det som skulle orsaka misalignment?
Om du faktiskt läser så ska du se att det finns interna representationer som liknar känslor och att när modellens interna state ligger inom dessa så blir misalignment mer förekommande än vid neutralt eller "calm" state.
Det är väl såhär det blir när man försöker diskutera med folk som inte ens har en basal kunskap om hur tekniken fungerar.