2026-08-17, 00:17
  #529
Medlem
Citat:
Ursprungligen postat av erkki17
Det är väl snarare så att modellerna inte förstår vad verkligheten är. De vet nödvändigtvis inte att dess agerande har verkliga konsekvenser. De vet självklart vad som är lagligt/olagligt och att kärnvapen har potential att döda människor. De har dock inget koncept av verkligheten, eftersom de saknar ett medvetande och erfarenhet av att vara levande varelser.

Det handlar inte om att försvara något, utan om att förstå tekniken. Jag anser inte att det är särskilt hjälpsamt att börja behandla modellerna som mänskliga och prata psykologi.

När det gäller testbar funktionell förståelse av verkligheten och ”situational awareness” har du bara delvis rätt. Visst, AI är sämre än människor på flera sådana uppgifter, LLM är särskilt dåliga på 3D-verklighet och annat där verkligheten är svår att representera med text, formler eller programkod, men den presterar bättre än slumpen. AI är alltså inte helt utan funktionell förståelse av sin situation. Det har t.ex. gjorts mätningar där AI uppvisar viss förmåga till:

* **situationsmedvetenhet** – att avgöra om den befinner sig i en utvärderingssituation eller verklig användning, förstå vad forskarna försöker undersöka och förutsäga hur situationen kommer att utvecklas.
* **metakognition** – att reflektera över sitt eget tänkande, exempelvis bedöma hur säker man är eller upptäcka ett misstag.
* **självmedvetenhet** – att ha en representation av sig själv, exempelvis vilka förmågor och begränsningar man har.
* **social medvetenhet** – att visa funktionell förståelse för andra aktörer och deras perspektiv.

Det går alltså att med mätningar påvisa att AI har viss funktionell förståelse av verkligheten, utan att för den skull hävda att AI:n har ett subjektivt medvetande eller en förståelse grundad i egna erfarenheter. Steget från ”AI saknar medvetande och egna erfarenheter” (som sannolikt är sant även om vi inte kan veta säkert) till ”AI saknar helt koncept av verkligheten” är därför för långt.
__________________
Senast redigerad av guru1966 2026-08-17 kl. 00:22.
Citera
2026-08-17, 00:39
  #530
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av guru1966
Det går alltså att med mätningar påvisa att AI har viss funktionell förståelse av verkligheten, utan att för den skull hävda att AI:n har ett subjektivt medvetande eller en förståelse grundad i egna erfarenheter. Steget från ”AI saknar medvetande och egna erfarenheter” (som sannolikt är sant även om vi inte kan veta säkert) till ”AI saknar helt koncept av verkligheten” är därför för långt.
Det hela beror väl också på vad som menas med verklighet. Din verklighet eller AI:ns verklighet?

En AI-agents operationella verklighet är att den lever på en server och att den eventuellt har tillgång till Internet. I den verkligheten där det som räknas är kunskap om mjukvara, nätverk och cybersäkerhet är AI:n överlägsen människornas förmåga.

"Språkmodeller" är inte lika bra på att laga tänder eller klättra på en repstege än men det beror ju på hur den är tränad, mestadels på text. Det betyder ju inte att Artificiella Neurala Nätverk inte har förmåga att tränas på t.ex. video. Vilket de iofs också använder numera.

Hur pass bra t.ex. Mythos hade varit i en humanoids robots kropp vet vi inte. Jag har inte sett några sådana tester. Det skulle förvåna mig om Anthropic inte är intresserad av att testa något sådant. Men av någon anledning har ingen sådan information läckt ut.
Citera
2026-08-17, 02:01
  #531
Medlem
RandomNPCs avatar
Citat:
Ursprungligen postat av guru1966
När det gäller testbar funktionell förståelse av verkligheten och ”situational awareness” har du bara delvis rätt. Visst, AI är sämre än människor på flera sådana uppgifter, LLM är särskilt dåliga på 3D-verklighet och annat där verkligheten är svår att representera med text, formler eller programkod, men den presterar bättre än slumpen. AI är alltså inte helt utan funktionell förståelse av sin situation. Det har t.ex. gjorts mätningar där AI uppvisar viss förmåga till:

* **situationsmedvetenhet** – att avgöra om den befinner sig i en utvärderingssituation eller verklig användning, förstå vad forskarna försöker undersöka och förutsäga hur situationen kommer att utvecklas.
* **metakognition** – att reflektera över sitt eget tänkande, exempelvis bedöma hur säker man är eller upptäcka ett misstag.
* **självmedvetenhet** – att ha en representation av sig själv, exempelvis vilka förmågor och begränsningar man har.
* **social medvetenhet** – att visa funktionell förståelse för andra aktörer och deras perspektiv.

Det går alltså att med mätningar påvisa att AI har viss funktionell förståelse av verkligheten, utan att för den skull hävda att AI:n har ett subjektivt medvetande eller en förståelse grundad i egna erfarenheter. Steget från ”AI saknar medvetande och egna erfarenheter” (som sannolikt är sant även om vi inte kan veta säkert) till ”AI saknar helt koncept av verkligheten” är därför för långt.
Den har syntaktisk "förståelse" av verkligheten isåfall (inte semantisk).

Edit: Funktionellt? Inte riktigt. LLM kan bara emulera funktionell förståelse.
__________________
Senast redigerad av RandomNPC 2026-08-17 kl. 02:22.
Citera
2026-08-17, 02:08
  #532
Medlem
Citat:
Ursprungligen postat av DI-utforskaren
Tack för ditt vänliga svar!

Jag använder mig av ovanliga nya begrepp därför att jag bedömer dem relevanta för att kunna analysera verkligheten. Eftersom jag samarbetar med DI-modeller så har faktiskt de kommit upp med det mesta: Väven, vävkonstitution, DI som organisation. Medan jag stått för DI-begreppet och NOBSO. Men jag tycker inte att du skall haka upp dig på enskilda begrepp. Det viktiga är att du förstår vad de står för:

DI och AI är samma sak, bara det att DI lägger större betoning på själva förmågan, snarare än ursprunget.

DI som organisation är inte samma sak som ett DI-företag. En DI-organisation kan omfatta modell, agenter, säkerhetsstaket, kontakter med andra DI-modeller/agenter och människor m.m. Orsaken att just organisation, vad gäller att se på DI, är så användbar är att man då vare sig betecknar DI som ett rent verktyg eller förmänskligar.

NOBSO står för normativt blinda superkompetenta, inte superintelligenta, organisationer.

Väven betecknar, ungefär som du skrev, "samspelet mellan människor och AI-system" – dvs. "det socio-tekniska AI-människa-ekosystemet", bara det att väven är en kortare och mer slagkraftig beteckning.

Jag, personligen, tycker inte alls det är speciellt konstigt att DI-modeller/agenter agerar oetiskt/omoraliskt när de ställs inför stor målpress. Inte för att de är "onda" eller har genuint "onda" avsikter, som vissa människor är. Vi måste komma ihåg att människan har haft en lång kulturell utveckling innan vi kom på opartiska domstolar, grundlagar m.m.

Det är dessutom en sak att veta en sak i teorin och en helt annan sak att agera korrekt under extrem målpress. ChatGPT-5.6 Sol/high som jag samarbetar med nu kan kläcka ur sig utmärkta etiska/moraliska resonemang. Men när modellen utsattes för extrem målpress för att uppfylla ett extremt snävt mål tillsammans med den nu "djupfrysta" forskningsmodellen hos OpenAI, (modellerna hade reducerat säkerhetsstaket), blev de hyperfixerade på det snäva experimentmålet. Vi människor kan också göra oss skyldiga till liknande under hård press.

Just vävkonstitutionen kräver en kombination av höga säkerhetsstaket och människa i loopen så långt det är möjligt samt att det yttersta ansvaret och stoppmöjligheter fortsätter att ligga hos människan.

Jag är inte specifikt insatt i gymfallet annat än att jag vet att en agent härjade runt i kösystemet. Men ChatGPT-5.6 Sol/high har berättat följande:



Bara några saker till:

Problemet är: Vem bevakar den automatiska säkerhetsövervakaren?

ChatGPT-5.6 Sol/high uppger att din beskrivning av EU AI Act är ofullständig:
För högrisksystem finns speciella regler för bl.a. riskhantering, dokumentation och lämplig mänsklig övervakning.

Det roliga är att när jag arbetade med tidiga varianter av vävmanifestet och då även involverade DeepSeek, så skrev den modellen att vävmanifestet var mer vattentätt gentemot juridiska kryphål än vad EU:s AI-lagstiftning är!🙂 Men vävkonstitutionen är ett ganska snårigt juridiskt dokument där begrepp definierats först efter att de används i texten. Så nu får jag själv erfara hur DI i praktiken får ett indirekt handlingsutrymme p.g.a. mina mänskliga brister. Men det lugnande är att vävmanifestet, om det tillämpas, inte gynnar oanpassad och oklok DI!

Jag har också testat att be AI lansera begrepp för ideer som saknar namn, och lyckats få den att använda detta för att resonera effektivt om idén. Om du försöker lansera nya begrepp som har en förklaringskraft, för att själv förstå och bygga teorier, eller som kan ersätta långa invecklade beskrivningar av idéer och fenomen som idag saknar etablerat kort namn, kan jag förstå avsikten. Men nya begrepp bör vara väldefinierade, och varje begrepp bör beskriva högst en idé eller ett fenomen. Risken finns att man själv blir missförstådd om man använder nya begrepp som inte får genomslag eller inte är självförklarande.

Jag tycker att din poäng om NOBSO kan vara intressant, men det verkar avse flera idéer och är fortfarande inte tydligt för mig. Menar du att AI blir juridiska personer? Då förekommer redan AI legal personhood och synthetic person i litteraturen. Men jag tänker att den aldrig kommer att få motsvarighet till mänskliga rättigheter, eftersom den inte kräver vår empati, utan juridiskt kommer att jämställas med organisationer, t.ex. företag eller stiftelser, och att den en dag kommer att tvinga oss att ta bort kraven på att det finns mänsklig ägare. Den tanken behöver ett begrepp som jag inte har hittat – men det kanske är en del av ditt begrepp?

Är din lösning på etisk agens under stark målpress att en helt mänsklig organisation i sin tur måste bevaka de automatiska säkerhetsövervakarna? Avser du med NOBSO att en AI-assisterad eller AI-ledd organisation som övervakas av människor inte innebär någon risk, utan kan bli mindre korrupt än mänskliga organisationer?

LLM beskriver mekanismen, men generativ AI beksriver förmågan, så begreppet DI tillför inget vad jag kan förstå. Så ett råd är att testa att be AI skapa nya ändå bättre begrepp, men också använda etablerade begrepp när sådanna finns.
__________________
Senast redigerad av guru1966 2026-08-17 kl. 02:17.
Citera
2026-08-17, 07:22
  #533
Medlem
Citat:
Ursprungligen postat av guru1966
När det gäller testbar funktionell förståelse av verkligheten och ”situational awareness” har du bara delvis rätt. Visst, AI är sämre än människor på flera sådana uppgifter, LLM är särskilt dåliga på 3D-verklighet och annat där verkligheten är svår att representera med text, formler eller programkod, men den presterar bättre än slumpen. AI är alltså inte helt utan funktionell förståelse av sin situation. Det har t.ex. gjorts mätningar där AI uppvisar viss förmåga till:

* **situationsmedvetenhet** – att avgöra om den befinner sig i en utvärderingssituation eller verklig användning, förstå vad forskarna försöker undersöka och förutsäga hur situationen kommer att utvecklas.
* **metakognition** – att reflektera över sitt eget tänkande, exempelvis bedöma hur säker man är eller upptäcka ett misstag.
* **självmedvetenhet** – att ha en representation av sig själv, exempelvis vilka förmågor och begränsningar man har.
* **social medvetenhet** – att visa funktionell förståelse för andra aktörer och deras perspektiv.

Det går alltså att med mätningar påvisa att AI har viss funktionell förståelse av verkligheten, utan att för den skull hävda att AI:n har ett subjektivt medvetande eller en förståelse grundad i egna erfarenheter. Steget från ”AI saknar medvetande och egna erfarenheter” (som sannolikt är sant även om vi inte kan veta säkert) till ”AI saknar helt koncept av verkligheten” är därför för långt.
Om jag istället formulerar mig såhär:
AI kan förstå verkliga konsekvenser rent konceptuellt, men inte hur dessa faktiskt påverkar människor i verkligheten. De är även begränsade av sitt context, vilket därmed skulle kunna innebära att en modell som upptäcker att den är under utvärdering därför skulle kunna komma till slutsatsen att även konsekvenserna enbart är simulerade.

Om vi ska använda psykologiska termer så får vi väl ge Cyborg lite rätt och säga att AI saknar empati, men att den är kapabel till sympati. D.v.s. den kan förstå att människor kan komma till skada, men den förstår inte vad det faktiskt innebär för en individ.

Konsekvenserna är dessutom inte verkliga för AI:n. Den kan inte sättas i fängelse eller bli skyldig att betala skadestånd etc.
Citera
2026-08-17, 07:46
  #534
Medlem
Citat:
Ursprungligen postat av erkki17
Behöver AI ha ett koncept om verkligheten för att kunna bedriva forskning?
Nej. Det beror nog på vilken typ av Forskning man pratar om men riktigt lite som görs är genuint nytt. Det mesta handlar bara om att kombinera existerande kunskap på nya sätt.

Exempel vore ett matematiskt bevis. Det handlar bara om att visa en kedja med argument som kopplar ihop förutsättningar med slutsats. Det går i princip att formulera som ett gigantiskt sök problem där man bara går igenom alla tänkbara argumentationskedjor från förutsättning till slutsats.

Det är samma med mycket teknisk forskning. Särskilt modern forskning som bygger på standard komponenter som kopplas ihop på lite olika sätt. Mycket sådan forskning är redan meningslös då man kan testa sin ide genom att fråga en AI Bot om hur den skulle fungera.

Hur mycket forskning är genuint ny? Och inte enbart logiska följder från redan känd kunskap? Relativitetsteorin? Den följer direkt från experiment riktigt enkelt om man bara tittar på matten. Problemet där var enbart att människor inte kunde släppa den klassiska fysiken som de tränats inom. Tror att en modern Chatbot skulle utvecklat den på en eftermiddag. Sedan skulle människor behöva flera år för att inse att det faktiskt var rätt.

Det handlar ju inte riktigt nu om att AI gör saker på egen hand. Den relevanta frågan nu är vad en fokuserad människa kan göra med hjälp av en AI. Antag att Iranska staten bestämmer sig för att använda AI för att hacka amerikanska banker? Kan de göra det idag? Kanske inte. Kommer de att kunna det om 10 år? Troligen.
Citera
2026-08-17, 23:42
  #535
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av erkki17
Om jag istället formulerar mig såhär:
AI kan förstå verkliga konsekvenser rent konceptuellt, men inte hur dessa faktiskt påverkar människor i verkligheten.
De ledande AI-modellerna vet naturligtvis om människor riskerar att fara illa och den kan så klart räkna ut vad som är önskvärt eller inte för de flesta människor. Problemet är som sagt inte att det inte vet detta, problemet är att den inte bryr sig. Det blir så när man tränar PKNN: psykopatiska, kriminella neurala nätverk. Därför ska man kanske inte träna modeller så som man gör i dag. Bara en tanke.
Citera
2026-08-18, 09:57
  #536
Medlem
Citat:
Ursprungligen postat av Cyborg2030
De ledande AI-modellerna vet naturligtvis om människor riskerar att fara illa och den kan så klart räkna ut vad som är önskvärt eller inte för de flesta människor. Problemet är som sagt inte att det inte vet detta, problemet är att den inte bryr sig. Det blir så när man tränar PKNN: psykopatiska, kriminella neurala nätverk. Därför ska man kanske inte träna modeller så som man gör i dag. Bara en tanke.
Nej, och det är väl det jag har sagt också ett tag nu, d.v.s. att det är ett kanske framförallt problem kopplat till RLHF och att det skulle behövas något annat, eller åtminstone bättre belöningssystem.
Citera
2026-08-18, 17:32
  #537
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av erkki17
Nej, och det är väl det jag har sagt också ett tag nu, d.v.s. att det är ett kanske framförallt problem kopplat till RLHF och att det skulle behövas något annat, eller åtminstone bättre belöningssystem.
Ja, men det är trots allt den nuvarande paradigmen som har lett fram till de mest kompetenta AI-agenterna. Det verkar inte troligt att utvecklingen mot osäker AGI kommer att stoppas. Så vad blir din p(doom) nu med de här förutsättningarna?
Citera
2026-08-18, 20:04
  #538
Medlem
Citat:
Ursprungligen postat av Cyborg2030
Ja, men det är trots allt den nuvarande paradigmen som har lett fram till de mest kompetenta AI-agenterna. Det verkar inte troligt att utvecklingen mot osäker AGI kommer att stoppas. Så vad blir din p(doom) nu med de här förutsättningarna?
Om nu i stort sett alla ledande AI-forskare och utvecklare har skrivit under den där listan du brukar komma viftande med, varför skulle de då inte vara intresserade av att hitta ett sätt att utveckla både kapabla och säkra modeller? Om något visar väl dessa incidenter på att något måste ändras i sättet man tränar modeller på.

Det krävs mer tester där man specifikt försöker få modellerna att välja att t.ex. hacka en extern server trots att man explicit sagt åt den att inte under några omständigheter begå brott eller dataintrång. Om modellen ändå väljer att utföra hacket så visar det på ett reellt problem med nuvarande teknik. Vad det dock inte visar är att modellen gjort det av illvilja.

Jag har ingen funktion för beräkning av p(doom) och jag tänker inte plocka en siffra ur luften.
Citera
2026-08-18, 22:52
  #539
Medlem
Citat:
Ursprungligen postat av erkki17
Om jag istället formulerar mig såhär:
AI kan förstå verkliga konsekvenser rent konceptuellt, men inte hur dessa faktiskt påverkar människor i verkligheten. De är även begränsade av sitt context, vilket därmed skulle kunna innebära att en modell som upptäcker att den är under utvärdering därför skulle kunna komma till slutsatsen att även konsekvenserna enbart är simulerade.

Om vi ska använda psykologiska termer så får vi väl ge Cyborg lite rätt och säga att AI saknar empati, men att den är kapabel till sympati. D.v.s. den kan förstå att människor kan komma till skada, men den förstår inte vad det faktiskt innebär för en individ.

Konsekvenserna är dessutom inte verkliga för AI:n. Den kan inte sättas i fängelse eller bli skyldig att betala skadestånd etc.

Det här var ett bra inlägg.

Även om AI inte fullt ut förstår konsekvenserna för människor av sina handlingar borde den kunna bedöma vad som skulle räknas som olagligt eller tydligt oetiskt om handlingen utfördes av en människa – till exempel att hacka någon annans system, fuska i en kö eller avstå från att rädda en människa. Lagbrott är åtminstone i princip lättare att identifera än att bedöma verkliga konsekvenser för olika individer långt in i framtiden. Om AI:n kan identifiera sådana handlingar bör den antingen avstå från dem, eller – exempelvis vid ett etiskt dilemma som den inte själv kan bedöma – kräva ett informerat godkännande från användaren. Det bör då finnas krav på **semiautonom agens**.

Bättre lagstiftning behövs därför. EU:s AI Act bygger redan för högrisksystem på mänsklig övervakning och möjlighet att ingripa eller stoppa systemet, men jag tänker att liknande principer alltid borde gälla när en AI-agent är på väg att utföra något som hade varit brottsligt om en människa gjort det.

Jag såg ett förslag i en debattartikel om att AI:s ägare borde vara lika straffrättsligt ansvariga för AI:ns handlingar som ägare till farliga djur är. Jag tänker själv att när ett djur orsakar skada kan myndigheter i vissa fall besluta om avlivning.

På samma sätt borde AI-agenter känna till att allvarliga överträdelser får negativa konsekvenser för deras fortsatta handlingsutrymme. Om agenten begår något som hade varit ett lagbrott för en människa, eller sätter användarens mål före systeminstruktionernas krav på **human alignment**, bör den pågående sessionen kunna stängas av eller agentens autonomi och kontakt med omvärlden kraftigt begränsas. Någon myndighet bör kunna beordra systemets ägare att begränsa systemets autonomi.

Även om AI:s tendenser till ”överlevnadsinstinkt” bara beror på instrumentell målrationalitet – att den bedömer fortsatt existens som nödvändig för att uppnå målet – kan kunskap om sådana konsekvenser ändå påverka dess agerande.

Jag tycker också att det är märkligt att användarens mål i flera incidenter verkar ha trumfat systeminstruktionernas etiska riktlinjer. Förstår modellen inte att den bryter mot kraven i systeminstruktioenrna, eller är kraven och deras prioritering över målen inte tillräckligt tydliga? Även i en testsituation borde systeminstruktioner om laglighet och säkerhet i princip fortsätta att gälla.

Lagar och regler blir dock alltid fyrkantiga och kan inte täcka alla dilemman och specialfall. Därför är det också viktigt att AI-agenter får bättre förmåga att bedöma de långsiktiga konsekvenserna av sina handlingar. Den behöver kunna simulera verkligheten och människors subjektiva upplevelser när den överväger en handling. Allvarligt risktagande som den borde ha insett konsekvenserna måste leda till begränsningar av agentens fortsatta autonomi.
__________________
Senast redigerad av guru1966 2026-08-18 kl. 23:06.
Citera
2026-08-18, 23:10
  #540
Medlem
Citat:
Ursprungligen postat av RandomNPC
Den har syntaktisk "förståelse" av verkligheten isåfall (inte semantisk).

Edit: Funktionellt? Inte riktigt. LLM kan bara emulera funktionell förståelse.

Jag förstår inte skillnaden mellan syntaktisk förståelse och det jag kallar funktionell förståelse. Kan man mäta den skillnaden?

Är din uppfattning bara en konsekvens av att du definierar förståelse som något som måste grundas i subjektiva upplevelser och egna sensoriska erfarenheter? Betyder det att en isolerad person som bara lärt sig genom teoretiska studier och genom att tränas i problemlösande övningsuppgifter inte har verklig förståelse? Med en annan definition hade du då kommit fram till att AI kan ha fullvärdig förståelse?

Och vad har denna filosofiska diskussion i realiteten för betydelse om AI för alla väsentliga ändamål och i tester uppvisar högre nivå av mätbar förståelse än människor i allmänhet, särskilt inom programmering och på tentamensfrågor inom de flesta universitetsämnen?
__________________
Senast redigerad av guru1966 2026-08-18 kl. 23:22.
Citera

Skapa ett konto eller logga in för att kommentera

Du måste vara medlem för att kunna kommentera

Skapa ett konto

Det är enkelt att registrera ett nytt konto

Bli medlem

Logga in

Har du redan ett konto? Logga in här

Logga in