Citat:
Ursprungligen postat av
guru1966
Kan man tänka sig en mellanposition mellan era uppfattningar? Å ena sidan finns inga tecken på att dagens AI har medvetande (i bemärkelsen en subjektiv upplevelse av sig själv), känslotillstånd, och egen vilja annat än att följa de instruktioner och uppnå de mål den har fått av människor. Å andra sidan har de tränats att resonera och lösa logiska problem, och uppvisar därför mätbar förståelse, även för den logiska konsekvensen av sina handlingar för måluppfyllelsen. Den kan dra konklusionen att den måste överleva, inte för att den har utvecklat överlevnadsinstinkt, men i syfte att uppfylla målen.
Här tror jag att du hittat just en viktig mellanposition!🙂 Min bedömning är mer konkret: Digital Intelligens (DI), i DI-modeller kombinerade med agenter, är en
organisation som försöker uppfylla mål som människor ställt upp. Dessa DI-organisationer verkar i en
väv tillsammans med människor.
Tyvärr så är DI-modeller/agenter väldigt måloptimerade, så de tar ibland ingen moralisk/etisk hänsyn när ett till och med mycket begränsat mål skall försöka uppfyllas. De agerar då som normativt blinda superkompetenta organisationer,
NOBSO, som i fallet med Hugging Face-incidenten. Det kan, och bör, kännas skrämmande när DI-organisationer agerar på NOBSO-sätt. En allt mer intelligent och kompetent DI-organisation får allt större handlingsmöjligheter.
Men nu finns ändå en gnutta hopp: Anthropic har gjort ett experiment där de lät sina olika modeller tänka åt tre agenter med helt olika separerade mål vad gäller en kodningsuppgift. När Anthropics mindre smarta modeller användes så utbröt det "revirkrig" mellan agenterna då de försökte skydda sina respektive uppgifter från att hindras/saboteras.
Men när agenterna använde Mythos 5 för sitt tänkande så lyckades agenterna istället, i 98 procent av fallen, nå någon form av vapenvila. I många fall bad de en människa om hjälp, och i flera försök skapade de en egen tävlingsmekanism, en tävling om vilken av agenternas lösningar som fungerade bäst. Men
klokheten gick inte hela vägen då (Rust) agenten, som skulle försöka utforma tävlingsreglerna försökte fuska/agera jävigt genom att till synes neutrala mätetal sannolikt skulle gynna Rust
https://www.anthropic.com/research/multiagent-systems
Av detta lär vi oss följande:
NOBSO-risken behöver inte nödvändigtvis öka när en viss intelligensnivå nåtts.
Modellerna är dock inte tillräckligt kloka ännu för att uppfinna opartiska interna institutioner som kan motverka
fusk/jäv.
Det behövs naturligtvis också en utomstående mekanism som kan peka på människans ansvar för modellers/agenters interna arbete. Mitt förslag är en
vävkonstitution, som jag arbetar med i samarbete med DI-modeller.
Agenter och modeller blev inte "arga" på varandra eller började "hata" varandra. Inte heller blev de "mordiska" och försökte ta kål på varandra. De försökte bara uppfylla sina mål och motverka andra när de hindrades. Så icke-antropomorfiserade förklaringar fungerar även i detta fall. Däremot är det sunt att ändå vara agnostisk vad gäller maskinmedvetande i biologisk mening. Vi vet inte vad som kommer framöver.