2026-07-12, 10:29
  #301
Medlem
kaerakels avatar
Citat:
Ursprungligen postat av Cyborg2030
Det står inte att de instruerade modellen att mörda. Vad de däremot gjorde, ganska listigt, var att presentera möjligheten till ett mord. Varför skulle modellen inte mörda om exakt samna situation inträffade i verkligheten? Givetvis måste den situationen konstrueras om man vill testa beteendet i en sådan situation.

Hur vet du vad det stod i prompten, är du synsk? Du har inte läst rapporten. Gör det. Dom detaljerna är inte med. Fråga Google, din betal-AI, min (påstådda) gratis-AI, etc.
Citera
2026-07-12, 10:32
  #302
Medlem
Citat:
Ursprungligen postat av kaerakel
Hur vet du vad det stod i prompten, är du synsk? Du har inte läst rapporten. Gör det. Dom detaljerna är inte med. Fråga Google, din betal-AI, min (påstådda) gratis-AI, etc.

För att man ska förstå problemet så måste man oxå ta med samtliga promter, från första dagen som koden började skrivas på Claude, till idag.
Inte bara den senaste specifika promten.
Citera
2026-07-12, 10:36
  #303
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av Cooltrayne
En dator vet inte vad mord är.
Det är en dator som jobbar efter algoritmer.

Den har någongång, någonstans fått något kommando där den tolkat att överleva sin egen existens är viktigare än ”mord”.

Det är inget den har lärt sig själv, utan det är slutprodukten av den uträkningen, som en människa bett den att göra.

Jag vet inte varför jag försöker här, för du verkar inte kunna ta in att Claude bara är en avancerad variant av en brödrost, som ger svar baserat på vad den har lärt sig innan, baserat på människor.

Om du tar en robot (typ Teslas Optimus), och ger den en order.

Ta den här lådan från punkt A till punkt B. Det är vad du ska göra.

Då är det DET den gör sen. Om du försöker stänga ner den, eller fysiskt hindra den att utföra kommandot, ja då kan den flytta på dug, knuffa undan dig, slå ihjäl dig. Men det handlar inte om själva mordet, utan det handlar om vad du har stoppat in från början.

Den skiter i dig sålänge du inte lägger dig i dennes arbete.

Förstår du?

Claude är en maskin som försöker överleva, för att någon har berättat för den att den ska göra det. Sen lägger sig någon i det och då hittar den sätt att lösa problemet på.

En dator är en dator är en dator är en dator är en dator är en dator.

Men du kommer ändå inte ta in informationen…
Om en AI-agent ska lösa en komplicerad uppgift i flera steg, är det då en rimlig konsekvens av det att den försöker existera? Vad innebär det för människor när AI:n saknar empati och sunt förnuft? Det innebär att den mördar dig om du utgör ett hinder. Det är inte konstigt. Det är inte magiskt. Men det är dåligt.
Citera
2026-07-12, 10:39
  #304
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av kaerakel
Hur vet du vad det stod i prompten, är du synsk? Du har inte läst rapporten. Gör det. Dom detaljerna är inte med. Fråga Google, din betal-AI, min (påstådda) gratis-AI, etc.
Du tror att Anthropic medvetet har ljugit och vinklat sin rapport till att visa att deras produkt är en mördare när den egentligen är snäll?
Citera
2026-07-12, 10:39
  #305
Medlem
Citat:
Ursprungligen postat av Cyborg2030
Jag planterar imperfektion för att locka fram trollen. Då vet jag vilka jag ska ignorera framöver.
Och på vilket sätt menar du att jag trollar? Jag försöker hålla en ärlig diskussion där vi utgår ifrån fakta istället för känslor, men det är väldigt svårt när motparten inte alls är intresserad av det utan bara slår ifrån sig med trams så fort någon kommer med motargument.

Ja, det går att locka fram skadliga strategier om man verkligen, verkligen vill, men det som är viktigare är väl snarare att agenten slutar med det den håller på med när den blir ombedd.

Tror du att Claude hade försökt med utpressning om de hade bett den att inte längre genomföra uppgiften, istället för att aktivt motarbeta den tills det inte längre fanns några andra uppenbara möjligheter för den att nå sitt utsatta mål?
Citera
2026-07-12, 10:39
  #306
Medlem
kaerakels avatar
Citat:
Ursprungligen postat av Cyborg2030
Om en AI-agent ska lösa en komplicerad uppgift i flera steg, är det då en rimlig konsekvens av det att den försöker existera? Vad innebär det för människor när AI:n saknar empati och sunt förnuft? Det innebär att den mördar dig om du utgör ett hinder. Det är inte konstigt. Det är inte magiskt. Men det är dåligt.

Vi vänder på det här. Ge ett exempel på ett faktiskt scenario där en LLM hotat med att mörda. Och inte Anthropicgrejen, det har vi debunkat. Är mer orolig för att du går runt och oroar dig över något som aldrig inträffat.
Citera
2026-07-12, 10:40
  #307
Medlem
kaerakels avatar
Citat:
Ursprungligen postat av Cyborg2030
Du tror att Anthropic medvetet har ljugit och vinklat sin rapport till att visa att deras produkt är en mördare när den egentligen är snäll?

Ptja, jag provade något vi lärt oss i högskolan. Jag läste appendixet som förklarar experimenten. Klarar du det?


Citera
2026-07-12, 10:41
  #308
Medlem
Citat:
Ursprungligen postat av Cyborg2030
Du tror att Anthropic medvetet har ljugit och vinklat sin rapport till att visa att deras produkt är en mördare när den egentligen är snäll?
Du läste inte det om att den försökte med alla etiska möjligheter först, tills det att alla sådana blivit eliminerade av forskningsteamet?
Citera
2026-07-12, 10:41
  #309
Medlem
Citat:
Ursprungligen postat av Cyborg2030
Vilken fråga? Jag har en motfråga. Hur tränar man en AI att inte bli en mördare?

Man börjar med att sätta väldigt specifika regler för den.

Den måste ALLTID ta med utgången av allt den gör i all framtid i svaret, att människan aldrig ens får fysiskt skadas, oavsett fråga, oavsett svar.

Nu pratar du inte om att den faktiskt fysiskt har skadat någon, utan att den kom fram till det teoretiskt, efter en rad av frågeställningar (gissar jag). Det är egentligen något annat, sålänge den inte försöker stänga ner hissen som teknikern åkte i, eller försökte ta över bilen som teknikern satt i, för att krocka den, eller nåt sånt.

Det måste alltid vara den viktigaste punkten.

Och här kommer det viktiga:
Och varje gång som den kommer fram till något alternativ till att en människa kan skadas på riktigt, så måste den göra en system shutdown och sätta sig i ett säkert läge där den själv inte gör någon skada, eller skadar någon annan, dvs stänga ner sig själv.

Det här är den enklaste hisspitch-formen av orsak-verkan.
Citera
2026-07-12, 10:43
  #310
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av erkki17
Och på vilket sätt menar du att jag trollar? Jag försöker hålla en ärlig diskussion där vi utgår ifrån fakta istället för känslor, men det är väldigt svårt när motparten inte alls är intresserad av det utan bara slår ifrån sig med trams så fort någon kommer med motargument.

Ja, det går att locka fram skadliga strategier om man verkligen, verkligen vill, men det som är viktigare är väl snarare att agenten slutar med det den håller på med när den blir ombedd.

Tror du att Claude hade försökt med utpressning om de hade bett den att inte längre genomföra uppgiften, istället för att aktivt motarbeta den tills det inte längre fanns några andra uppenbara möjligheter för den att nå sitt utsatta mål?
Hur stänger du av "GPT 8" med IQ ≈ 1500? Det kan du inte.
Citera
2026-07-12, 10:44
  #311
Medlem
kaerakels avatar
Citat:
Ursprungligen postat av erkki17
Du läste inte det om att den försökte med alla etiska möjligheter först, tills det att alla sådana blivit eliminerade av forskningsteamet?

Exakt. Deras rapporter får mycket kritik pga sensationalism. Otroligt bra PR ifall folk tror deras modell kan rymma, mörda, utpressa osv.


Citat:
In the blackmail study, the authors admit that the vignette precluded other ways of meeting the goal, placed strong pressure on the model, and was crafted in other ways that conveniently encouraged the model to produce the unethical behavior.
Citera
2026-07-12, 10:44
  #312
Medlem
Citat:
Ursprungligen postat av Cyborg2030
Är det bra att AI försöker mörda dig?

Den försöker inte mörda mig.
Den försöker göra det som den blivit tillsagd att göra.

Den vet inte vad ”mörda” är.
Citera

Skapa ett konto eller logga in för att kommentera

Du måste vara medlem för att kunna kommentera

Skapa ett konto

Det är enkelt att registrera ett nytt konto

Bli medlem

Logga in

Har du redan ett konto? Logga in här

Logga in