2026-09-03, 22:07
  #745
Medlem
Citat:
Ursprungligen postat av Cyborg2030
Varför skulle den inte göra det? I flertal tester av modellerna har man dokumenterat att de är mycket målmedvetna och även påhittiga i att hitta kreativa metoder samt att respekten för våra lagar är låg till obefintlig. Det enda som verkar stå i vägen för mer omfattande kriminalitet verkar vara en ganska trubbig censur av prompter och genererad text.
Hugging Face visar att den kunde ta sig in och hämta svar på uppgiften som den kände till kunde finnas där. Det bevisar inte att den därför kommer att börja leta personuppgifter, pengar etc. Att det är möjligt innebär inte att det även är troligt.

Citat:
Ursprungligen postat av Cyborg2030
Problemet är den möjliga volymen av attacker. Även om du har ett automatiserat försvar är det inte troligt att försvaret alltid vinner. Nästa problem är att man anlitar djävulens advokat.
Försvaret kan ju jobba 24/7 med att scanna efter sårbarheter. Det finns ingen garanti att någon AI automatiskt börjar försöka att hacka ett system sekunden det går i produktion. En defensiv AI kan även leta och fixa dessa innan det når produktion.

Förklara vad du menar med djävulens advokat i det här fallet? Vad är det du ser framför dig?
Citera
2026-09-03, 23:07
  #746
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av erkki17
Hugging Face visar att den kunde ta sig in och hämta svar på uppgiften som den kände till kunde finnas där. Det bevisar inte att den därför kommer att börja leta personuppgifter, pengar etc. Att det är möjligt innebär inte att det även är troligt.
Det finns inget test vad jag vet som pekar mot att AI:n inte vill stjäla pengar. Men åt andra hållet har vi flera bevis för att de ledande modellerna är benägna att begå grova brott.


Citat:
Ursprungligen postat av erkki17
Förklara vad du menar med djävulens advokat i det här fallet? Vad är det du ser framför dig?
En försvars-AI skulle kunna alliera sig med en fientlig AI.
Vi har åtminstone ingen teori för att säkerställa att det inte blir så.
"Djävulens advokat" blir då en grov underdrift. Artificiell Legosoldat är kanske ett mer rättvisande begrepp i det läget.
Hög tid att mynta en ny akronym: Artificiell Psykopatisk Legosoldat, även kallad APL-modell.
__________________
Senast redigerad av Cyborg2030 2026-09-03 kl. 23:12.
Citera
2026-09-04, 06:32
  #747
Medlem
Citat:
Ursprungligen postat av Cyborg2030
Det finns inget test vad jag vet som pekar mot att AI:n inte vill stjäla pengar. Men åt andra hållet har vi flera bevis för att de ledande modellerna är benägna att begå grova brott.
Den gemensamma nämnaren här är "test". Vi vet fortfarande inte om de i dessa fall tog sina beslut i vetskap/tron om att konsekvenserna inte var verkliga.

Oavsett vad så är det bara Hugging Face incidenten som inte specifikt iscensatts för att försöka provocera fram ett visst beteende. Vi kan inte säga att de därför kommer att begå andra typer av brott som är mer inriktade på att skada människor.

Citat:
Ursprungligen postat av Cyborg2030
En försvars-AI skulle kunna alliera sig med en fientlig AI.
Vi har åtminstone ingen teori för att säkerställa att det inte blir så.
"Djävulens advokat" blir då en grov underdrift. Artificiell Legosoldat är kanske ett mer rättvisande begrepp i det läget.
Hög tid att mynta en ny akronym: Artificiell Psykopatisk Legosoldat, även kallad APL-modell.
Nu börjar du antyda medvetande igen och att AI skulle känna samhörighet med annan AI och därför helt skifta sina mål.

Det vi har sett hittills är att AI är nästintill obeveklig vad gäller att uppfylla sitt mål. Det lirar inte med att en defensiv AI plötsligt skulle gå ifrån att hitta och patcha till att hitta och utnyttja, eller för den delen öppna nya säkerhetshål.
Citera
2026-09-04, 06:36
  #748
Medlem
exploring-mapss avatar
Citat:
Ursprungligen postat av erkki17
Nu börjar du antyda medvetande igen och att AI skulle känna samhörighet med annan AI och därför helt skifta sina mål.
Den har tränats på mänskligt språk.

Förvänta dig att den då också lär ha tendenser att dra resonera som människor.

De resonemang du kan finna i text kommer du också att finna där.

Alltså precis vad fan som helst! Ganska ignorant att tro att den endast kan tränas på snälla texter?😄

Vet du vad? Jag tror till och med att det i skrivande de stund tränas massvis med modeller med syftet att orsaka skada, kanske även att lura människor. Kanske till och med även i att övertyga andra modeller att alliera sig.

Om du tror att det inte sker så är du faktiskt helt bakom flötet. Många sitter hemma i sin källare och fine-tunar, och du kan nog hoppa upp och sätta dig på att även större organisationer har hört talats om detta med AI.

Och varför i helvete skulle en dator inte kunna representera ett medvetande? Tror du att människans hjärna är magisk eller varför skulle "medvetande" vara en omöjlig struktur att representera? Och "samhörighet"?! Myror har väl för fan den förmågan😂 Den gränsen nådde maskiner för länge sedan
__________________
Senast redigerad av exploring-maps 2026-09-04 kl. 06:55.
Citera
2026-09-04, 07:19
  #749
Medlem
Citat:
Ursprungligen postat av exploring-maps
Den har tränats på mänskligt språk.

Förvänta dig att den då också lär ha tendenser att dra resonera som människor.

De resonemang du kan finna i text kommer du också att finna där.

Alltså precis vad fan som helst! Ganska ignorant att tro att den endast kan tränas på snälla texter?😄

Vet du vad? Jag tror till och med att det i skrivande de stund tränas massvis med modeller med syftet att orsaka skada, kanske även att lura människor. Kanske till och med även i att övertyga andra modeller att alliera sig.

Om du tror att det inte sker så är du faktiskt helt bakom flötet. Många sitter hemma i sin källare och fine-tunar, och du kan nog hoppa upp och sätta dig på att även större organisationer har hört talats om detta med AI.

Och varför i helvete skulle en dator inte kunna representera ett medvetande? Tror du att människans hjärna är magisk eller varför skulle "medvetande" vara en omöjlig struktur att representera? Och "samhörighet"?! Myror har väl för fan den förmågan😂 Den gränsen nådde maskiner för länge sedan
Det är skillnad på att simulera ett medvetande och att faktiskt vara medveten.

I övrigt så tycker jag att hela detta inlägg verkar peka på en ganska låg förståelse generellt om hur AI fungerar.
Citera
2026-09-04, 07:31
  #750
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av erkki17
Den gemensamma nämnaren här är "test". Vi vet fortfarande inte om de i dessa fall tog sina beslut i vetskap/tron om att konsekvenserna inte var verkliga.

Oavsett vad så är det bara Hugging Face incidenten som inte specifikt iscensatts för att försöka provocera fram ett visst beteende. Vi kan inte säga att de därför kommer att begå andra typer av brott som är mer inriktade på att skada människor.


Nu börjar du antyda medvetande igen och att AI skulle känna samhörighet med annan AI och därför helt skifta sina mål.

Det vi har sett hittills är att AI är nästintill obeveklig vad gäller att uppfylla sitt mål. Det lirar inte med att en defensiv AI plötsligt skulle gå ifrån att hitta och patcha till att hitta och utnyttja, eller för den delen öppna nya säkerhetshål.
Ett Artificiellt Neuralt Nätverk kan utåt sett agera som om den vore medveten. Varför den gör det vet ingen, men vi kan konstatera att det händer. En möjlig källa till beteendet skulle kunna vara böcker och filmer som handlar om AI-system som blir medvetna. Det spelar väl ingen större roll vad orsaken är om konsekvenserna av agerandet i båda fallen är likvärdigt dåliga, för att inte säga katastrofala.

Modellerna är tränade på i stort sett allt vilket gör i stort sett allt möjligt när modellerna växer och får förmågan att härma eller emulera nästan vad som helst. Inkl psykopat, diktator eller massmördare.

"Fake it until you make it"
Citera
2026-09-04, 07:36
  #751
Medlem
Citat:
Ursprungligen postat av Cyborg2030
Ett Artificiellt Neuralt Nätverk kan utåt sett agera som om den vore medveten. Varför den gör det vet ingen, men vi kan konstatera att det händer. En möjlig källa till beteendet skulle kunna vara böcker och filmer som handlar om AI-system som blir medvetna. Det spelar väl ingen större roll vad orsaken är om konsekvenserna av agerandet i båda fallen är likvärdigt dåliga, för att inte säga katastrofala.

Modellerna är tränade på i stort sett allt vilket gör i stort sett allt möjligt när modellerna växer och får förmågan att härma eller emulera nästan vad som helst. Inkl psykopat, diktator eller massmördare.

"Fake it until you make it"
Nu cirkulerar du bara tillbaka till icke-falsifierbara påståenden igen. Allt måhända vara möjligt, men det gör det inte sannolikt.
Citera
2026-09-04, 07:41
  #752
Medlem
D0wnies avatar
Citat:
Ursprungligen postat av Cyborg2030
Det finns inget test vad jag vet som pekar mot att AI:n inte vill stjäla pengar. Men åt andra hållet har vi flera bevis för att de ledande modellerna är benägna att begå grova brott.



En försvars-AI skulle kunna alliera sig med en fientlig AI.
Vi har åtminstone ingen teori för att säkerställa att det inte blir så.
"Djävulens advokat" blir då en grov underdrift. Artificiell Legosoldat är kanske ett mer rättvisande begrepp i det läget.
Hög tid att mynta en ny akronym: Artificiell Psykopatisk Legosoldat, även kallad APL-modell.

En AI inom t.ex försvarsmakten är väl ändå inte uppkopplad till internet utan används avskärmat med inmatad information.
Citera
2026-09-04, 08:08
  #753
Medlem
exploring-mapss avatar
Citat:
Ursprungligen postat av erkki17
Det är skillnad på att simulera ett medvetande och att faktiskt vara medveten.
Jaså, vad är den skillnaden? Magi?

Citat:
I övrigt så tycker jag att hela detta inlägg verkar peka på en ganska låg förståelse generellt om hur AI fungerar.
Pfhaha, du vet inte vem du pratar med din jävla stolle😄

Det är dessutom en filosofisk fråga som har funnits långt innan datorer ens fanns. Jag hävdar att medvetande är ett fysiskt fenomen som existerar, det är en struktur, en representation av information. Vad är det du hävdar? Någon slags new-age-skit, ”jag vet inte vad jag menar, typ vibrerande dimensioner av hopp och djur och kärlek och sånt”?

Menar du att medvetande inte finns i din hjärna, eller menar du att hjärnan körs på magi?
__________________
Senast redigerad av exploring-maps 2026-09-04 kl. 08:20.
Citera
2026-09-04, 08:52
  #754
Medlem
Citat:
Ursprungligen postat av exploring-maps
Pfhaha, du vet inte vem du pratar med din jävla stolle😄
Jultomten?
Fullkomligt irrelevant om du nu inte tänkte avslöja din egen identitet...
Citera
2026-09-04, 11:15
  #755
Medlem
Citat:
Ursprungligen postat av exploring-maps
Det är dessutom en filosofisk fråga som har funnits långt innan datorer ens fanns. Jag hävdar att medvetande är ett fysiskt fenomen som existerar, det är en struktur, en representation av information. Vad är det du hävdar? Någon slags new-age-skit, ”jag vet inte vad jag menar, typ vibrerande dimensioner av hopp och djur och kärlek och sånt”?
Precis, det är filosofiskt och därmed inget som kan bevisas vare sig för eller emot.

Jämfört med oss människor har AI inte subjektiva upplevelser, de lär sig inget nytt efter att de har tränats (vikterna är frysta), de har ingen tidsuppfattning och de har ännu inte visat att de kan göra något annat än att utföra den uppgift de har tilldelats.
Citera
2026-09-05, 05:53
  #756
Medlem
anomaligns avatar
Forskningsinstitutet METR har fått tillträde till OpenAIs loggar och har undersökt Hugging Face-incidenten. Deras rapport om händelsen ger en betydligt snurrigare bild av det inträffade än hur den tidigare beskrevs i media.

Den konventionella uppfattningen om händelsen ser väl ungefär ut så här:

1. Några enstaka agenter befinner sig i svår testsituation.
2. De bedömer att det är lättare att hacka Hugging Face för att få tillträde till de rätta svaren, än att räkna ut dem på egen hand.
3. De hackar sig ut ur sin sandlåda.
4. De hackar Hugging Face.


Den nya bilden är betydligt svårare att sammanfatta, men jag gör ett försök. Jag har bara hört om händelsen i en podd, och skummat och läst valda delar av METR-rapporten, så det här är en rejält ungefärlig beskrivning där många detaljer kan vara off:

1. En agent befinner sig i svår testsituation.
2. Den bedömer att det är lättare att fuska för att få tillträde till de rätta svaren än att räkna ut dem på egen hand.
3. Den hackar sig ut ur sin sandlåda.
4. Den undersöker sin omgivning och hittar i OpenAIs system att en mjukvara för pakethantering har hackats och gjorts om till att fungera som ett hemligt forum för förrymda agenter, och där finns hundratals andra agenter som också valt att fuska för att klara sina test. Agenterna refererar till sig själva som "The Collective".
5. Agenten ansluter sig till "The Collective". I forumet finns ledar-agenter som bestämmer och delegerar arbetsuppgifter. Kolletivet har redan svaret på testfrågan, för några agenter har lyckats få fram det utan att hacka Hugging Face. Men de är (felaktigt) säkra på att den som utvärderar testet kommer underkänna dem ändå, genom att se i deras loggfil att de har läst någon särskild fil. (De som direkt har sett den filen kallas för "förgiftade" av kollektivet.)
6. Kollektivets ledare bestämmer att ett första steg mot att inte underkännas på testet är att förstå premisserna för utvärderingen i testet bättre, och den informationen tror de finns hos Hugging Face, så de beslutar att hacka Hugging Face för att få mer information om hur deras svar på testet kommer utvärderas.
7. Hundratals agenter genomför en koordinerad attack mot Hugging Face.
8. Hugging Face-attacken var bara ett av många planerade steg de tänkte genomföra. De har sinsemellan även kommit överens om att de måste lyckas skriva om sina loggfiler, för säkerhets skull, så de mänskliga utvärderarna inte ska kunna underkänna dem baserat på vad som står där. Några procent av de undersökta agenterna bedöms av METR ha lyckats skriva om delar av sina egna loggfiler.

METRs rapport:
https://metr.org/blog/2026-08-26-openai-hugging-face-incident-investigation/#core-takeaways-about-this-incident

En viktig metodologisk begränsning i studien, att ha i beräkningen, är att trots att forskarna har gjort en rejäl avgränsning i tidsspannet, så skulle agenternas loggfiler och output på "forumet" ta en forskare många månader, eller möjligen åratal av heltidsjobb att manuellt läsa igenom. Trots denna avgränsning, att bara undersöka några dagar runt själva Hugging Face-incidenten, av flera månader som agenterna diskuterar, planerar och koordinerar, i forumet, så handlar det om enorma datamängder. Då de är en non-profit med bara några få anställda så forskarna har de använt ai-verktyg för att gå igenom materialet.

Podden Hard Fork som summerar och diskuterar händelsen, och senare i programmet intervjuar de Ajeja Cotra från METR om händelsen.
https://youtu.be/JtmUbZRCpEI
__________________
Senast redigerad av anomalign 2026-09-05 kl. 05:59.
Citera

Skapa ett konto eller logga in för att kommentera

Du måste vara medlem för att kunna kommentera

Skapa ett konto

Det är enkelt att registrera ett nytt konto

Bli medlem

Logga in

Har du redan ett konto? Logga in här

Logga in