Citat:
Ursprungligen postat av
EgonKarman
Jo, men fel görs väl även vid kodning av program. Det går väl dessutom att hitta en gynnsam felmarginal och applicera naturligt urval där med?
Fast det är irrelevant här. Det man strävar efter är att utdata skall nå ett visst rätt svar.
Det är som jag försökt förklara för cyborgaren utan framgång.
Tränar du ett NN på att leverera kvadratrötter så blir det bättre och bättre på just kvadratrötter. Det är INTE så att med mycket träning så börjar det plötsligt leverera 3:e roten.
När man vet hur NN fungerar och träning av dessa så blir det bara absurt att det skall börja leverera 3:e roten (eller bli "intelligentare än träningsdatat").
Med reinforcement learning så kan man potentiellt hitta nya lösningar på problem. Men det är ett helt annat djur än språkmodellerna. Och tränas på ett helt annat sätt.
Sedan är inte de så fantastiska heller i många sammanhang. T ex finns triviala gamla Atari-spel där de går rejält bet. Pga träningsmetoderna. Det lär gå att förbättra men då talar vi forskning i åratal.
Vissa andra problem är de utmärkta på. Jfr AlphaFold.