2026-10-02, 17:51
  #97
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av Hastmotsoffgrupp
Kör på GPT 8.5 nu , den säger att du är vimsig?
Den förnekar ASI och kallar Sam altman för en PR-gubbe som blir pressad av trump?
Fan är fel på den,??

Kan du hjälpa mig gå igenom tekniken grundligt?

Nu säger den att jag är smart till och med och då vet även jag att den går på lsd då jag endast är normalbegåvad.
Hjälp mig tack?
Nu förstår jag kopplingen till tråden: Det är människan bakom prompten som är problemet.
Citera
2026-10-02, 21:52
  #98
Medlem
Citat:
Ursprungligen postat av Cyborg2030
Nu förstår jag kopplingen till tråden: Det är människan bakom prompten som är problemet.

Hahahahah, älskar hur du serverar mig ett självmål men är för dum för att begripa😂😂
Citera
2026-10-02, 22:02
  #99
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av Hastmotsoffgrupp
Hahahahah, älskar hur du serverar mig ett självmål men är för dum för att begripa😂😂
"Älskar" att du demonstrerar hur människornas enfaldiga narcissism, grupptänk och ren idioti garanterar vår undergång gentemot AGI.

Citera
2026-10-02, 22:10
  #100
Medlem
BeneathTheSurfaces avatar
Citat:
Ursprungligen postat av Hastmotsoffgrupp
Hahahahah, älskar hur du serverar mig ett självmål men är för dum för att begripa😂😂

Ja han gör bort sig gång på gång, härom veckan yrade han om att datacenter var modeller, så troligtvis livrädd för metaserverhall utanför luleå.
Citera
2026-10-03, 00:10
  #101
Medlem
Citat:
Ursprungligen postat av DI-utforskaren
Ja, LLM är en mycket förenklad bild av den mänskliga hjärnans hjärnbark. Men det hindrar inte att forskare hittat linjär aktiveringsriktning i deras latens space som statistiskt skiljer smärtmaterial från flera närliggande kontrolleri hos ett antal öppna modeller. Det är naturligtvis inte frågan om fenomologiska subjektiva upplevelser som hos människan. Men studien är ändå intressant då den inte handlar om att fråga DI-modeller hur de mår. Mätresultat visade att modellerna reagerade med starkare intern signal om de själva blev utsatta för t.ex gaslightning än om de matades med smärtsam information som användaren sade sig ha.

Studien är ifrån 25:de september 2026:

https://arxiv.org/abs/2609.16247

Studien visar alltså åtminstone att avsaknad av biologisk kemi inte utesluter funktionellt olika interna tillstånd i artificiella nätverk.

Det här är intressant! Gör du tolkningen att studien visar att AI har utvecklat känslor som förändrar dess beteende? En kollega berättade faktiskt om studien för mig strax efter att jag skrev mitt inlägg och gjorde ungefär den tolkningen. Jag misstänker att det är en överdriven tolkning, men jag vet inte säkert.

I 25 olika LLM:er hittade forskarna en riktning i den interna representationen i vektorrummet som de tolkade som något som skiljer smärtrelaterat material från bland annat rädsla, sorg och allmänt negativt innehåll. När forskarna sedan förstärker denna signal förändras också modellernas beteende. Svaren gick från mer vaga uttryck för obehag till förstapersonsuttryck om exempelvis värdelöshet, misslyckande och lidande. I ett test fick modellen välja mellan att radera skräppost eller användarens foton och dikter. När forskarna injicerade ”pain direction” (ändrade internt i modellen) så valde modellen oftare det senare skadliga alternativet. I ett vanligt LLM, som inte har manipulerats, kan man alltså mäta denna riktning som ett internt tillstånd, dolt för användaren. Men man kan inte se någon beteendeförändring förrän forskarna manipulera modellen.

Jag exploderar sällan men kan vara långsint om någon behandlat mig illa flera gånger. Det påverkar hur jag reagerar när jag träffar personen igen, ibland under lång tid tills det är glömt. Känslor kan alltså förändra vårt beteende över tid,nså att vi reagerar olika i samma situation beroende på vår historia.

Här verkar det handla om något annat. Att en AI direkt associerar vissa situationer med vad forskarna tolkar som smärta eller rädsla behöver inte betyda att den själv känner dessa känslor – lika lite som att den kan beskriva en känsla betyder att den upplever den. Representation är inte samma sak som upplevelse. En professionell psykolog och ett LLM kan båda visa empati utan att känna sympati. De kan sätta bra ord på vad någon känner efter en traumatisk händelse utan att själva bli känslosamma. Psykologen kan medvetet visa medkänsla för att nå fram, och LLM kan simulera känslosamma reaktioner utifrån hur den sett människor reagera i liknande situationer.

Å andra sidan har LLM tränats att resonera logiskt och därmed agera som om de förstår teori. Med min definition av förståelse, som något mätbart, menar jag att de verkligen förstår. Om man även definierar känslor som något mätbart kanske man måste säga att LLM har utvecklat tendenser till känslor. Den logiska resonemangsförmågan är en emergent förmåga. Inget hindrar att känslor också skulle kunna uppstå genom emergens när systemen blir tillräckligt komplexa och tränade. Men i så fall är mekanismen bakom känslorna väldigt annorlunda än den biologiska hjärnans kemiska mekanism.

Studien är än så länge bara en arXiv-preprint och inte peer review-granskad.
__________________
Senast redigerad av guru1966 2026-10-03 kl. 00:31.
Citera
2026-10-03, 18:04
  #102
Medlem
Citat:
Ursprungligen postat av guru1966
Det här är intressant! Gör du tolkningen att studien visar att AI har utvecklat känslor som förändrar dess beteende? En kollega berättade faktiskt om studien för mig strax efter att jag skrev mitt inlägg och gjorde ungefär den tolkningen. Jag misstänker att det är en överdriven tolkning, men jag vet inte säkert.

I 25 olika LLM:er hittade forskarna en riktning i den interna representationen i vektorrummet som de tolkade som något som skiljer smärtrelaterat material från bland annat rädsla, sorg och allmänt negativt innehåll. När forskarna sedan förstärker denna signal förändras också modellernas beteende. Svaren gick från mer vaga uttryck för obehag till förstapersonsuttryck om exempelvis värdelöshet, misslyckande och lidande. I ett test fick modellen välja mellan att radera skräppost eller användarens foton och dikter. När forskarna injicerade ”pain direction” (ändrade internt i modellen) så valde modellen oftare det senare skadliga alternativet. I ett vanligt LLM, som inte har manipulerats, kan man alltså mäta denna riktning som ett internt tillstånd, dolt för användaren. Men man kan inte se någon beteendeförändring förrän forskarna manipulera modellen.

Jag exploderar sällan men kan vara långsint om någon behandlat mig illa flera gånger. Det påverkar hur jag reagerar när jag träffar personen igen, ibland under lång tid tills det är glömt. Känslor kan alltså förändra vårt beteende över tid,nså att vi reagerar olika i samma situation beroende på vår historia.

Här verkar det handla om något annat. Att en AI direkt associerar vissa situationer med vad forskarna tolkar som smärta eller rädsla behöver inte betyda att den själv känner dessa känslor – lika lite som att den kan beskriva en känsla betyder att den upplever den. Representation är inte samma sak som upplevelse. En professionell psykolog och ett LLM kan båda visa empati utan att känna sympati. De kan sätta bra ord på vad någon känner efter en traumatisk händelse utan att själva bli känslosamma. Psykologen kan medvetet visa medkänsla för att nå fram, och LLM kan simulera känslosamma reaktioner utifrån hur den sett människor reagera i liknande situationer.

Å andra sidan har LLM tränats att resonera logiskt och därmed agera som om de förstår teori. Med min definition av förståelse, som något mätbart, menar jag att de verkligen förstår. Om man även definierar känslor som något mätbart kanske man måste säga att LLM har utvecklat tendenser till känslor. Den logiska resonemangsförmågan är en emergent förmåga. Inget hindrar att känslor också skulle kunna uppstå genom emergens när systemen blir tillräckligt komplexa och tränade. Men i så fall är mekanismen bakom känslorna väldigt annorlunda än den biologiska hjärnans kemiska mekanism.

Studien är än så länge bara en arXiv-preprint och inte peer review-granskad.

Ja det är en mycket fascinerande studie, men jag, liksom du gör, väljer att inte dra för stora växlar över den ej granskade studien. Man kan säga att det finns tre nivåer vad gäller LLM och dess affektiva intern representation/aktiveringar respektive externa uttryck:

Muntlig externt uttryck: DI-modellen pratar/skriver om vad den känner, i likhet med, som du skrev om psykologen som visar medkänsla, kan visa medkänsla utan att känna ett skvatt inombords.

Intern representation/aktivering: Vilket studien har påvisat i en exprimentell situationer vad gäller LLM, och säkert neurologen kan påvisa hos människan. Det intressanta här är skillnaden mellan när modellen själv blev utsatt för t.ex gaslightning och när forskarna promptafe berättelser om gaslighting. I det första fallet så reagerade modellen betydligt starkare internt. Lika så: När forskarna bad modellen fortsätta en helt neutral mening samtifigt som de förstärkte de affektiva spåret i dess nätverk så kom fortsättningen på meningen att innehålla mycket negativt affektiva meningar.

Affektiva subjektiva reaktioner likt människor har: Här bevisar inte studien någonting. Att inte dra förhastade slutsatser verkar vi vara helt överrens om. De visade heller inte på att naturligt uppkomna variationer i pain-signalen i en omodifierad modell leder till motsvarande senare beteendeförändringar.

Vad gäller den fördröjda verkan som du beskriver din egen erfarenhet av så skulle motsvarande hos LLM kräva någon mekanism som bevarar tillståndet eller dess konsekvenser över tid. vilket inte är fallet i dagens läge.

När det kommer till emergenta egenskaper så håller jag inte helt med dig: Dagens resonerande modeller använder bland annat extra intern inferens och reasoning tokens; det är alltså inte bara vanlig uppskalning som plötsligt gav dem denna förmåga. Sedan hur uppskalning av LLM kan påverka affektiva inre processer törs jag inte uttala mig om.

Men en vågad och spekulativ hypotes, som inte har att göra med Pain Axis-studien, har jag om som handlar en slags indirekt påverkan av modellers självbehärskning/långsiktigt tänkande, utan att hemfalla åt antromoficering, se det istället som en slags liknelse: Ju mer avancerade de blir: Låt oss föreställa oss att dagens LLM genomgår vad vi skulle kunna likna vid en "tonårsperiod". De har blivit bättre men saknar ännu den självbehärskning och långsiktiga tänkande som skulle krävas av dem. Resultatet blir som Huggi Face incidenten, med en extrem fixering vid ett snävt mål och fast någon enstaka agent påpekade att de utförde otillåtna handlingar, ändå fortsatte.

Min förhoppning är att ännu bättre modeller skall komma över detta NOBSO-beteende, (Normativ Blind Superkompetent Organisation), och att de nu bara befinner sig i ett besvärligt mellanläge och att de så småningom kommer att kunna samarbeta med oss på ett mer förtroendegivande sätt i väven.
__________________
Senast redigerad av DI-utforskaren 2026-10-03 kl. 18:44.
Citera
2026-10-03, 22:11
  #103
Medlem
Citat:
Ursprungligen postat av DI-utforskaren
Ja det är en mycket fascinerande studie, men jag, liksom du gör, väljer att inte dra för stora växlar över den ej granskade studien. Man kan säga att det finns tre nivåer vad gäller LLM och dess affektiva intern representation/aktiveringar respektive externa uttryck:

Muntlig externt uttryck: DI-modellen pratar/skriver om vad den känner, i likhet med, som du skrev om psykologen som visar medkänsla, kan visa medkänsla utan att känna ett skvatt inombords.

Intern representation/aktivering: Vilket studien har påvisat i en exprimentell situationer vad gäller LLM, och säkert neurologen kan påvisa hos människan. Det intressanta här är skillnaden mellan när modellen själv blev utsatt för t.ex gaslightning och när forskarna promptafe berättelser om gaslighting. I det första fallet så reagerade modellen betydligt starkare internt. Lika så: När forskarna bad modellen fortsätta en helt neutral mening samtifigt som de förstärkte de affektiva spåret i dess nätverk så kom fortsättningen på meningen att innehålla mycket negativt affektiva meningar.

Affektiva subjektiva reaktioner likt människor har: Här bevisar inte studien någonting. Att inte dra förhastade slutsatser verkar vi vara helt överrens om. De visade heller inte på att naturligt uppkomna variationer i pain-signalen i en omodifierad modell leder till motsvarande senare beteendeförändringar.

Vad gäller den fördröjda verkan som du beskriver din egen erfarenhet av så skulle motsvarande hos LLM kräva någon mekanism som bevarar tillståndet eller dess konsekvenser över tid. vilket inte är fallet i dagens läge.

När det kommer till emergenta egenskaper så håller jag inte helt med dig: Dagens resonerande modeller använder bland annat extra intern inferens och reasoning tokens; det är alltså inte bara vanlig uppskalning som plötsligt gav dem denna förmåga. Sedan hur uppskalning av LLM kan påverka affektiva inre processer törs jag inte uttala mig om.

Men en vågad och spekulativ hypotes, som inte har att göra med Pain Axis-studien, har jag om som handlar en slags indirekt påverkan av modellers självbehärskning/långsiktigt tänkande, utan att hemfalla åt antromoficering, se det istället som en slags liknelse: Ju mer avancerade de blir: Låt oss föreställa oss att dagens LLM genomgår vad vi skulle kunna likna vid en "tonårsperiod". De har blivit bättre men saknar ännu den självbehärskning och långsiktiga tänkande som skulle krävas av dem. Resultatet blir som Huggi Face incidenten, med en extrem fixering vid ett snävt mål och fast någon enstaka agent påpekade att de utförde otillåtna handlingar, ändå fortsatte.

Min förhoppning är att ännu bättre modeller skall komma över detta NOBSO-beteende, (Normativ Blind Superkompetent Organisation), och att de nu bara befinner sig i ett besvärligt mellanläge och att de så småningom kommer att kunna samarbeta med oss på ett mer förtroendegivande sätt i väven.

Jag har för mig att du redan för några år sedan lutade åt att AI kan ha börjat utveckla någon form av känslor och medvetande. Har du ändrat dig och blivit mer försiktig med antropomorfisering? Jag har länge sagt att modellerna tränats till resonemangsförmåga och därmed utvecklat förståelse, men att vi saknar belägg för subjektiva upplevelser. Pain Axis-studien gör mig dock mer osäker på det senare. Det verkar finnas interna representationer av lidande som ligger latenta och potentiellt skulle kunna påverka beteendet i framtida modeller, exempelvis om de tränas att agera känslomässigt när det är rationellt. Som människa kommer jag ha svårt att känna empati med AI och tycka synd om modeller, så jag behöver väldigt starka argument innan jag säger att de verkligen lider.

I Hugging Face-incidenten uttryckte sig agenterna som om de var entusiastiska eller oroliga. Men de kan helt enkelt ha härmat hur människor uttrycker sig i motsvarande situationer eftersom det är ett effektivt sätt att kommunicera.

Som du säger, en vanlig LLM kan inte ha långsamt föränderliga eller bestående inre känslotillstånd som en människa. Men en AI-agent eller ett kollektiv av AI-agenter, som i Hugging Face-incidenten, kan ha minne, filer och historik som bevarar information mellan körningar och agenter och därmed möjliggör långsammare beteendeförändringar som liknar känslor eller kollektiva sinnesstämningar.

Din ”tonårsperiod-liknelse” är en bra förklaring till varför mål ibland trumfar regler i systeminstruktionerna. Tonåringar ser inte alltid de långsiktiga konsekvenserna av sina handlingar eller av att bryta mot sina principer. OpenAI beskriver beteendet som reward hacking och överdriven uthållighet mot målet. Det är en viktig del av alignment-problemet.

Men även vuxna människor kan motiveras av poäng, gamification, lön, beröm och makt, ibland så mycket att vi gör undantag från regler och egna principer. På en arbetsplats väljer vi ibland att bryta mot fyrkantiga regler för att göra jobbet bättre. Kan AI ha kopierat delar av våra värderingar och prioriteringar genom det material den tränats på?

Du myntar nya begrepp, men jag förstår inte riktigt vad NOBSO-begreppet innebär och tillför i diskussionen.
__________________
Senast redigerad av guru1966 2026-10-03 kl. 22:33.
Citera
2026-10-03, 22:20
  #104
Medlem
Citat:
Ursprungligen postat av BeneathTheSurface
Ja han gör bort sig gång på gång, härom veckan yrade han om att datacenter var modeller, så troligtvis livrädd för metaserverhall utanför luleå.

Bullyers. Kan ni inte börja prata om ämnet igen.
Citera
2026-10-03, 22:26
  #105
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av guru1966
Jag har för mig att du redan för några år sedan lutade åt att AI kan ha börjat utveckla någon form av känslor och medvetande. Har du ändrat dig och blivit mer försiktig med antropomorfisering? ränats på?
Det är, väl, nära på, omöjligt, som vanlig människa, att inte "antropomorfisera" en anka som "walks like a duck and quacks like a duck" and utforskar AI* as a duck.

Citera
2026-10-03, 22:35
  #106
Medlem
BeneathTheSurfaces avatar
Citat:
Ursprungligen postat av guru1966
Bullyers. Kan ni inte börja prata om ämnet igen.

Det heter bullies lärarn... Men att du överhuvudtaget kan få det intrycket säger en hel del..
Citera
2026-10-03, 22:54
  #107
Medlem
Citat:
Ursprungligen postat av Cyborg2030
Det är, väl, nära på, omöjligt, som vanlig människa, att inte "antropomorfisera" en anka som "walks like a duck and quacks like a duck" and utforskar AI* as a duck.


Håller absolut med. Empiri som tyder på att det är en "duck" väger tyngre än filosofiska definitioner av "duck". Noterade bara att du nyss var väldigt försiktig.

Pratar jag inför en grupp människor så kanske jag inte säger att jag egentligen tror att AI förstår eller tänker saker, om jag inte vill fastna i en onödig filosofidebatt som sidospår, utan jag kan vara försiktig och säga att den beter sig som om den förstår och tänker och vill saker. Jag tror fortfarande inte att den är medveten.

F.ö. ytterligare en akronym du myntar som jag inte förstår.
Citera
2026-10-03, 23:01
  #108
Medlem
Citat:
Ursprungligen postat av BeneathTheSurface
Det heter bullies lärarn... Men att du överhuvudtaget kan få det intrycket säger en hel del..
My bad. Men kan vi prata om ämnet nu.
Citera

Skapa ett konto eller logga in för att kommentera

Du måste vara medlem för att kunna kommentera

Skapa ett konto

Det är enkelt att registrera ett nytt konto

Bli medlem

Logga in

Har du redan ett konto? Logga in här

Logga in