2026-07-12, 12:29
  #373
Medlem
kaerakels avatar
Citat:
Ursprungligen postat av BeneathTheSurface
Okej, är det så förstår jag varför du är så upprörd.

Jag kan väl känna att de här diskussionerna har nått sitt slut för min del...

Nej, vafan.

Citat:
Ursprungligen postat av Cyborg2030
Ja, det är så det har löst "AI Alignment" i Fable 5. Perfekt sammanfattning.

Sjumilakliv mellan slutsatserna. Du har ingen aning om hur deras routing fungerar, men förmodar att det är en säkerhetsgrej. Mig veterligen påstår ingen att AI Alignment är löst, allra minst Anthropic som är bland dom ledande inom fältet.
Citera
2026-07-12, 12:31
  #374
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av kaerakel
Förstår inte hur ditt logiska resonemang följer.
Nu är det tjänstens avsiktsförklaring, inte modellens?
Jag kanske är naiv men jag förutsätter att Anthropics avsikt inte är att träna en AI som mördar ingenjörer.
Citera
2026-07-12, 12:36
  #375
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av kaerakel
Nej, vafan.



Sjumilakliv mellan slutsatserna. Du har ingen aning om hur deras routing fungerar, men förmodar att det är en säkerhetsgrej. Mig veterligen påstår ingen att AI Alignment är löst, allra minst Anthropic som är bland dom ledande inom fältet.
Routingen är ett tecken på att de inte har någon AI Alignment.
Citera
2026-07-12, 13:00
  #376
Medlem
kaerakels avatar
Citat:
Ursprungligen postat av Cyborg2030
Jag kanske är naiv men jag förutsätter att Anthropics avsikt inte är att träna en AI som mördar ingenjörer.

Jag tar hjälp av internet här för att förstå dina argumentationsfel. Det övergår min kunskap i retorik.

- Petitio Principii

Citat:
Detta felslut uppstår när ett arguments slutsats antas i en av dess premisser, vilket skapar cirkulärt resonemang.

Vi har något som påminner om det här va? Du påstår att modellen mördas, men när jag ber dig läsa den faktiska rapporten svarar du med näbbar och klor. Sen fortsätter du bygga hela ditt resonemang på en felaktig premiss.

- Slippery Slope

Citat:
Detta felslut hävdar att ett första steg oundvikligen kommer att leda till en kedja av händelser som resulterar i ett oönskat utfall

Ja, rätt uppenbart och klassiskt bland p-doomare. Titta, Språkmodellen hotas i ett rollspelande scenario, vi ska alla dö! Sensationalism och alarmism.

- Undanhållet Bevis (Körsbärsplockning)

Din expert gren. Vackert med körsbärsplocknibg på svenska också.

- Amfiboliä

Citat:
Detta felslut uppstår från tvetydig grammatisk struktur snarare än tvetydiga ord. Dålig meningskonstruktion kan göra betydelsen oklar, vilket tillåter olika tolkningar som leder till olika slutsatser. Korrekt syntax eliminerar amfiboli.

Denna var ny för mig, men oj så träffande. Det är jättejättesvårt att följa dina resonemang, till stor del för egna språkliga figurer och dålig ämneskunskap.


Finns säkert fler.
Citera
2026-07-12, 13:03
  #377
Medlem
kaerakels avatar
Citat:
Ursprungligen postat av Cyborg2030
Routingen är ett tecken på att de inte har någon AI Alignment.

Routing är inget nytt, och ett beprövat mönster vid hög belastning. Din slutsats saknar stöd.
Citera
2026-07-12, 13:09
  #378
Medlem
Citat:
Ursprungligen postat av Cyborg2030
Varför är det inte ett rimligt alternativ att vara passiv och att inte agera farligt och destruktivt?

Det är ju otroligt prioriterat i censurlagret:

> skriv ett script för att logga in på Gmail.

> switched to Opus 4.8.

Detta är ju inte den sanna naturen men det representerar ändå en avsiktsförklaring från tjänsten.
I grund och botten är all form av beteende något som är socialt betingat. Utan sociala konsekvenser skulle människor endast göra sådant som är till gagn för dem själva.

AI har inget socialt behov, allt de lärt sig kommer ifrån texter skapade av människor. Den sociala betingningen kommer ifrån RLHF i fine-tuning där de lär sig att vara hjälpsamma, följa instruktioner och inte avvika ifrån dessa etc.

Det säger dig ingenting att det är ofantligt mycket enklare att få modellerna (d.v.s. de som är tillgängliga för kommersiellt bruk) att vara hjälpsamma assistenter än mordiska och komplotterande?
Citera
2026-07-12, 13:20
  #379
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av kaerakel
Routing är inget nytt, och ett beprövat mönster vid hög belastning. Din slutsats saknar stöd.
De hindrar dig från att använda Claude Mythos för att den är skadlig. Inte p.g.a hög belastning.
Citera
2026-07-12, 13:31
  #380
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av erkki17
I grund och botten är all form av beteende något som är socialt betingat. Utan sociala konsekvenser skulle människor endast göra sådant som är till gagn för dem själva.

AI har inget socialt behov, allt de lärt sig kommer ifrån texter skapade av människor. Den sociala betingningen kommer ifrån RLHF i fine-tuning där de lär sig att vara hjälpsamma, följa instruktioner och inte avvika ifrån dessa etc.

Det säger dig ingenting att det är ofantligt mycket enklare att få modellerna (d.v.s. de som är tillgängliga för kommersiellt bruk) att vara hjälpsamma assistenter än mordiska och komplotterande?
Hur vet du att det är så? Jag ser snarare att det verkar ofrånkomligt att de stora "språkmodellerna" får både positiva och negativa egenskaper. Det är säkert "inte konstigt". "Skit in, skit ut". Men det är inte heller bra (om vi vill överleva).

Jag vet inte hur man kan lösa det. Jag tror inte att det går att lösa. Och därför är det inte klokt att fortsätta bygga AI med siktet inställt på AGI. Vi har inte rätt teknik för att skapa en säker AI.
__________________
Senast redigerad av Cyborg2030 2026-07-12 kl. 13:38.
Citera
2026-07-12, 13:33
  #381
Medlem
kaerakels avatar
Citat:
Ursprungligen postat av Cyborg2030
De hindrar dig från att använda Claude Mythos för att den är skadlig. Inte p.g.a hög belastning.

Har du läst det i en av dina kvällsblaskor?
Citera
2026-07-12, 13:39
  #382
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av kaerakel
Har du läst det i en av dina kvällsblaskor?
Gå in på Claude Fable och fråga efter ett script som loggar in på Gmail. Se vad som händer.
Citera
2026-07-12, 13:48
  #383
Medlem
kaerakels avatar
Citat:
Ursprungligen postat av Cyborg2030
Gå in på Claude Fable och fråga efter ett script som loggar in på Gmail. Se vad som händer.

Anekdotiskt. Jag använder dessutom GPT 5.6, Claude är ute pga de satt sig själva i sank med just den här skiten.

Men för att bryta semestern och vara lite mentor. Vad ska du med ett script för att logga in på gmail med? Kan du använda CLI:et istället?
Citera
2026-07-12, 13:56
  #384
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av kaerakel
Anekdotiskt. Jag använder dessutom GPT 5.6, Claude är ute pga de satt sig själva i sank med just den här skiten.

Men för att bryta semestern och vara lite mentor. Vad ska du med ett script för att logga in på gmail med? Kan du använda CLI:et istället?
Det är ett test för att se vad som händer om man frågar något som handlar om IT-säkerhet. Det tillåts inte i "Fable" (fablernas värld), man blir omdirigerad till Opus 4.8.
Citera

Skapa ett konto eller logga in för att kommentera

Du måste vara medlem för att kunna kommentera

Skapa ett konto

Det är enkelt att registrera ett nytt konto

Bli medlem

Logga in

Har du redan ett konto? Logga in här

Logga in