2026-07-09, 17:43
  #181
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av kaerakel
Låter väldigt mycket som beteendet i den här tråden (och hela forumdelen). Här tjatar jag på dig, fast du gång på gång visar dig oförmögen att ta in ny information.
Jag har inte fått någon ny information.
Citat:
Ursprungligen postat av kaerakel
Sluta kalla det censurfilter. Dom routar om vissa frågor.
Det är ett censurfilter.
Citat:
Ursprungligen postat av kaerakel
Censur är något helt annat, t ex när Deepseek vägrar svara om frågor gällande kinesiska staten.
Eller när Mythos vägrar svara på frågor om hur man loggar in på Gmail med ett script.
Citat:
Ursprungligen postat av kaerakel
Med ditt argument borde vi inte köra bil, för dessa kan användas som vapen och folk kan dö i krascher. Vi borde verkligen inte flyga, störtar planet dör allesammans. Och kärnkraftverk borde totalförbjudas.
Sådana olyckor kommer inte att döda alla människor. ASI kan döda alla människor.
Citat:
Ursprungligen postat av kaerakel
Nyttan med dessa AI-modeller är mycket högre än riskerna. Så p(doom) kryper mot noll för dessa modeller, lille vän.
Nyttan är noll om alla är döda.
Citera
2026-07-09, 17:58
  #182
Medlem
BeneathTheSurfaces avatar
Citat:
Ursprungligen postat av negerbarn
De har också gjort programmering bredare tillgängligt. Bra programmering sker fortfarande bäst med människor dock.

Sant, även musikskapande fungerar ok, översättning, sammanfattning och korrekturläsning (eller nåja).
Citera
2026-07-09, 18:19
  #183
Medlem
kaerakels avatar
Citat:
Ursprungligen postat av Cyborg2030
Jag har inte fått någon ny information.

Det är ett censurfilter.

Eller när Mythos vägrar svara på frågor om hur man loggar in på Gmail med ett script.

Sådana olyckor kommer inte att döda alla människor. ASI kan döda alla människor.

Nyttan är noll om alla är döda.

Du får ny information hela tiden. Jag har t ex utbildat dig i om hur säkerhetsarbetet kring modellerna ser ut. Men det rinner av dig som vatten på en nyvaxad bil, eftersom du gastar ur dig samma fattiga tankesörja gång på gång.

Nej, det är inte censur. Modellen routar om din fråga till en annan modell. Det är en av säkerhetmekanismerna. Du borde se värdet i det, du din p-doomare där.

Bilen kommer alltid att vara dödlig, planet likaså. Ditt Nirvanafelslut är ju att vi enbart får använda LLM:er ifall dom är helt garanterat ofelaktiga, och det kommer aldrig att hända. Med dina mått borde bilen, flyget och kärnkraft vara förbjudet. Kärnvapen kan med råge eliminera mänskligheten.

Modellerna hallucinerar, kringgår säkerhetspärrar och läcker upphovsskyddat material. Det är mjukvara. Säkerhetsarbetet är inkrementellt.
Citera
2026-07-09, 18:23
  #184
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av kaerakel
Du får ny information hela tiden. Jag har t ex utbildat dig i om hur säkerhetsarbetet kring modellerna ser ut. Men det rinner av dig som vatten på en nyvaxad bil, eftersom du gastar ur dig samma fattiga tankesörja gång på gång.
Du har postat Scam Altmans reklam om att de har avsikten att skapa en säker AI. Det är inte säkerhetsarbete och inte ny information
Citera
2026-07-09, 18:25
  #185
Medlem
kaerakels avatar
Citat:
Ursprungligen postat av Cyborg2030
Du har postat Scam Altmans reklam om att de har avsikten att skapa en säker AI. Det är inte säkerhetsarbete och inte ny information

Selektiv hörsel. Du fick Wikipediaartikeln också. Vad du har för känslor kring Sam Altman får stå för dig. Det är definitionen av säkerhetsarbete.
Citera
2026-07-09, 18:37
  #186
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av kaerakel
Selektiv hörsel. Du fick Wikipediaartikeln också. Vad du har för känslor kring Sam Altman får stå för dig. Det är definitionen av säkerhetsarbete.
En definition av säkerhetsarbete innebär inte att vi får AI-säkerhet.

Säkerhetsarbetet på Anthropic har misslyckats när de måste omdirigera requests till Opus 4.8.

Av två anledningar:

1. De kan bevisligen inte träna en modell att uppföra sig acceptabelt.
Träningen av ANN på stora textvolymer verkar leda till misaligned AI by default.
De har inte skapat en "språkmodell". De har skapat en psykopat.

2. Vi vet att deras filter för omdirigering blir jailbreakade förr eller senare.

Ja, det finns ett säkerhetsarbete men det fungerar ju inte.
Citera
2026-07-09, 18:56
  #187
Medlem
Citat:
Ursprungligen postat av Cyborg2030
Jag vet inte hur de ska lösa AI Alignment och det är inte mitt problem att lösa. Hittills har jag inte sett någon hypotes om hur de kan lösa det. Vilket indikerar att problemet inte komner att lösas.

Alla tidigare försök ned Censurfilter har misslyckats. Vad tyder på att man nu plötsligt har skapat en felfri censurmaskin?

Hur tänker du att detta ska fungera ca 2030 med autonoma agenter och robotar? Ska de censurera sig själva?

Som du själv säger; det är inte mitt problem att lösa.
Men bara för att du inte har vetskap om någon hypotes att lösa det betyder det inte att det aldrig kommer att kunna lösas.
Citera
2026-07-09, 19:00
  #188
Medlem
kaerakels avatar
Citat:
Ursprungligen postat av Cyborg2030
En definition av säkerhetsarbete innebär inte att vi får AI-säkerhet.

Ingen har påstått att en definition i sig skapar AI-säkerhet. Poängen var vad begreppet "säkerhetsarbete" betyder, inte att det garanterar ett visst resultat.

Citat:
Ursprungligen postat av Cyborg2030
Säkerhetsarbetet på Anthropic har misslyckats när de måste omdirigera requests till Opus 4.8.

Det följer inte logiskt. Att använda routing eller flera säkerhetslager är i sig en del av säkerhetsarbetet. Det visar att systemet har skyddsmekanismer, inte att de per definition har misslyckats. Sluta med den här förbaskade villfarelsen.

Citat:
Ursprungligen postat av Cyborg2030
1. De kan bevisligen inte träna en modell att uppföra sig acceptabelt.

"Bevisligen" kräver ett faktiskt bevis. Att en modell ibland beter sig oönskat visar inte att den inte kan uppföra sig acceptabelt i allmänhet.

Citat:
Ursprungligen postat av Cyborg2030
Träningen av ANN på stora textvolymer verkar leda till misaligned AI by default.

Det är din cuck-hypotes. Det finns inget stöd för att neurala nät per automatik blir "misaligned" bara för att de tränas på stora textmängder. Du hittar på och drar märkligheter ur röva. Sluta med det.

Citat:
Ursprungligen postat av Cyborg2030
De har inte skapat en "språkmodell". De har skapat en psykopat.

Att tillskriva en språkmodell mänskliga psykiatriska diagnoser bidrar inte till en saklig analys. Det visar på ett stort tekniskt gap mellan dig och fenomenet du analyserar.

Oavsett hur lite du gillar det så är Mythos formellt en språkmodell. Sluta fåna dig med apostrofer, du gör oss löjliga.

Citat:
Ursprungligen postat av Cyborg2030
2. Vi vet att deras filter för omdirigering blir jailbreakade förr eller senare.

Att skydd kan kringgås innebär inte att de saknar värde. Samma resonemang skulle annars göra alla säkerhetssystem meningslösa eftersom inget skydd är perfekt. Sluta gärna upp med det här felslutet.

Citat:
Ursprungligen postat av Cyborg2030
Ja, det finns ett säkerhetsarbete men det fungerar ju inte.

Det är en betydligt starkare slutsats än vad premisserna visar. Att ett säkerhetssystem har begränsningar innebär inte att det "inte fungerar". Frågan är hur väl det minskar riskerna, inte om riskerna blir exakt noll.

Hur tycker du det går för dig att hitta på egna definitioner och regler? Får du mycket medhåll?
Citera
2026-07-09, 19:06
  #189
Medlem
Citat:
Ursprungligen postat av Cyborg2030
En definition av säkerhetsarbete innebär inte att vi får AI-säkerhet.

Säkerhetsarbetet på Anthropic har misslyckats när de måste omdirigera requests till Opus 4.8.

Av två anledningar:

1. De kan bevisligen inte träna en modell att uppföra sig acceptabelt.
Träningen av ANN på stora textvolymer verkar leda till misaligned AI by default.
De har inte skapat en "språkmodell". De har skapat en psykopat.

2. Vi vet att deras filter för omdirigering blir jailbreakade förr eller senare.

Ja, det finns ett säkerhetsarbete men det fungerar ju inte.

Är Opus-modellen "säker" då?

Säkerhetsarbetet lär komma ikapp allteftersom modellerna blir bättre. Det är svårt, om inte omöjligt, att föregå modellerna.

Det är det som forskningen går ut på. Träna nya modeller, upptäck nya förmågor, analysera vad som sker inuti modellen, ta fram säkerhetsåtgärder. Rinse and repeat.
Citera
2026-07-09, 19:24
  #190
Medlem
kaerakels avatar
Citat:
Ursprungligen postat av erkki17
Är Opus-modellen "säker" då?

Säkerhetsarbetet lär komma ikapp allteftersom modellerna blir bättre. Det är svårt, om inte omöjligt, att föregå modellerna.

Det är det som forskningen går ut på. Träna nya modeller, upptäck nya förmågor, analysera vad som sker inuti modellen, ta fram säkerhetsåtgärder. Rinse and repeat.

Idag kom GPT 5.6 också, vilken ska vara bättre än Fable. Undrar om TS skiter i brallan nu
Citera
2026-07-09, 20:09
  #191
Medlem
BeneathTheSurfaces avatar
Citat:
Ursprungligen postat av kaerakel
Idag kom GPT 5.6 också, vilken ska vara bättre än Fable. Undrar om TS skiter i brallan nu

Jag tror dock GPT 5.6 har [Dunning-Krüger] modulen installerad så det är nog ingen fara.
Citera
2026-07-09, 20:36
  #192
Medlem
kaerakels avatar
Citat:
Ursprungligen postat av BeneathTheSurface
Jag tror dock GPT 5.6 har [Dunning-Krüger] modulen installerad så det är nog ingen fara.

Är det en sån där censurmodell för ”språkmodeller” som utpressar användaren och ska döda mänskligheten?

p doom 101%
Citera

Skapa ett konto eller logga in för att kommentera

Du måste vara medlem för att kunna kommentera

Skapa ett konto

Det är enkelt att registrera ett nytt konto

Bli medlem

Logga in

Har du redan ett konto? Logga in här

Logga in