2026-07-15, 17:13
  #649
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av erkki17
Ptja, det är ju bl.a. det man studerar inom Mechanistic Interpretability.
Ptja, man har börjat förstå att det behövs. De har inte därför löst Mechanistic Interpretability. De är inte nära där heller.
Citat:
Ursprungligen postat av erkki17
Det går alltså att inspektera dess "hidden states" och se vilka algoritmer som utgörs av beräkningarna av aktiveringsfunktionerna Ännu har man bara lyckats på mindre modeller, men vad säger att det inte skulle gå att lösa för större?
Nyss fick man inte tro något om framtiden, det är "inte bevis"? Men den måttstocken gäller inte dig?
Poängen är att vi i dag inte har den transparens som krävs för AI-säkerhet och det är väldigt oklart om det ens är möjligt.

I takt med att modellerna blir ännu bättre är det inte troligt att man kommer närmare en lösning. De artificiella neurala nätverken har ju redan avslöjats med att utpressa, vilseleda, fuska och ljuga. Man har också observerat att AI-agenter som pratar med varandra kan göra det på ett sätt som vi inte kan förstå. Om modellen vill dölja något för dig då kan den högst sannolikt göra det. De skulle också kunna vilseleda oss så att vi tror att vi har Mechanistic Interpretability, men egentligen visas bara en mask och inte faktiska avsikter eller förmågor. Du har absolut ingen aning om hur man löser det heller.

P(doom) ökar stadigt i den här tråden 🤷🏻‍♂️
Citera
2026-07-15, 17:25
  #650
Medlem
kaerakels avatar
Citat:
Ursprungligen postat av Cyborg2030
Kan du beskriva vad som händer i ett ANN när ovanstående löstes? Nej, det kan du inte. Varken du eller någon annan är i närheten av en förklaring. Därför kan du inte heller utesluta andra förmågor, t.ex. en rudimentärt medvetande, överlägsen intelligens, eller ett embryo till en emergent, autonom vilja eller målbild. Trådens poäng är gjord flera gånger om nu 🤷🏻‍♂️

Svara gärna med fler personangrepp, alla förstår ju vad det innebär 🤷🏻‍♂️🕺🏻

Det fetstilade har vi avhandlat.

Du är inte tillräckligt insatt i litteraturen för att göra ett sådant påstående. Du är inte heller tillräckligt beläst för att ta till dig denna litteratur, vilken jag har gett dig på ett silverfat. Det du har är en smältdegel av felslut och argumentationsfel, bland annat auktoritetsargument och dålig grammatik. Det här är inte påhopp, måhända spydigt, men fortfarande sanning baserat på observationer. Förstår om det gör ont — förlåt för det, lillebror. Med tuff kärlek växer du.

Två fina deviser att leva efter är ”Det som kan hävdas utan belägg kan förkastas utan belägg” och ”extraordinära påståenden kräver extraordinära bevis”, båda uttrycken lånade från större hjärnor än min. Att påstå något som medvetande i LLM:er är helt grundlöst. Det påminner mer om teologiska diskussioner med fundamentalister.
Citera
2026-07-15, 17:27
  #651
Medlem
kaerakels avatar
Citat:
Ursprungligen postat av Cyborg2030
Så kan man se det. Man kan också se det som en mer sannolikt prognos än den andra prognosen som vi inte har sett någon formulera. Om du har en konkurrerande prognos kanske du kan presentera den, i stället för att underkänna hela konceptet med prognoser. Men det är väl mycket enklare att klaga, gnälla, märka ord och hänga upp sig på petitesser?

P(doom | LLM:er) = 0

Kom ihåg var du hörde det först.
Citera
2026-07-15, 17:28
  #652
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av kaerakel
Det fetstilade har vi avhandlat.

Du är inte tillräckligt insatt i litteraturen för att göra ett sådant påstående. Du är inte heller tillräckligt beläst för att ta till dig denna litteratur, vilken jag har gett dig på ett silverfat.
Som jag trodde, mer personangrepp 🤷🏻‍♂️
Alla förstår vad det innebär.
Citera
2026-07-15, 17:33
  #653
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av kaerakel
P(doom | LLM:er) = 0

Kom ihåg var du hörde det först.

Ett mycket stort artificiellt neuralt nätverk kan användas som en "LLM" men den kan inte tränas till att endast vara en "LLM". Det är bara ett önsketänkande från din sida.

Du representerar den gränslösa naivitet som leder till att AI-förmågor utvecklas mycket snabbare än AI-säkerhet.
Citera
2026-07-15, 17:43
  #654
Medlem
Citat:
Ursprungligen postat av Cyborg2030
Ptja, man har börjat förstå att det behövs. De har inte därför löst Mechanistic Interpretability. De är inte nära där heller.

Nyss fick man inte tro något om framtiden, det är "inte bevis"? Men den måttstocken gäller inte dig?
Poängen är att vi i dag inte har den transparens som krävs för AI-säkerhet och det är väldigt oklart om det ens är möjligt.

I takt med att modellerna blir ännu bättre är det inte troligt att man kommer närmare en lösning. De artificiella neurala nätverken har ju redan avslöjats med att utpressa, vilseleda, fuska och ljuga. Man har också observerat att AI-agenter som pratar med varandra kan göra det på ett sätt som vi inte kan förstå. Om modellen vill dölja något för dig då kan den högst sannolikt göra det. De skulle också kunna vilseleda oss så att vi tror att vi har Mechanistic Interpretability, men egentligen visas bara en mask och inte faktiska avsikter eller förmågor. Du har absolut ingen aning om hur man löser det heller.

P(doom) ökar stadigt i den här tråden 🤷🏻‍♂️
Det är ett kortare hopp från att vi kan inspektera mindre modeller till att det även fungerar på större än det är från att modeller kan lösa IQ test till att de vill mörda oss.

p(success) är gissningsvis 80 %

Mechanistic Interpretability mäter de fysiska beräkningarna som sker. Du får i så fall tala om hur modellen ska maska detta utan att falla tillbaka på din IQ 7500 som klarar av att böja fysikens lagar efter dess vilja.
Citera
2026-07-15, 17:48
  #655
Medlem
kaerakels avatar
Citat:
Ursprungligen postat av kaerakel
Det du har är en smältdegel av felslut och argumentationsfel, bland annat auktoritetsargument och dålig grammatik. Det här är inte påhopp, måhända spydigt, men fortfarande sanning baserat på observationer. Förstår om det gör ont — förlåt för det, lillebror. Med tuff kärlek växer du.

Två fina deviser att leva efter är ”Det som kan hävdas utan belägg kan förkastas utan belägg” och ”extraordinära påståenden kräver extraordinära bevis”, båda uttrycken lånade från större hjärnor än min. Att påstå något som medvetande i LLM:er är helt grundlöst. Det påminner mer om teologiska diskussioner med fundamentalister.

Du glömde visst läsa hela inlägget?

Citat:
Ursprungligen postat av Cyborg2030
Som jag trodde, mer personangrepp 🤷🏻‍♂️
Alla förstår vad det innebär.

Det är inte personangrepp. Det är en iakttagelse. På sin höjd är det vetenskapligt arbete. Säg en person i den här tråden som inte är arg på dig, så kan jag nämna dom som är arga på dig.
Citera
2026-07-15, 17:50
  #656
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av erkki17
Det är ett kortare hopp från att vi kan inspektera mindre modeller till att det även fungerar på större än det är från att modeller kan lösa IQ test till att de vill mörda oss.
Mordförsök har ju redan observerats i tester.
Citat:
Ursprungligen postat av erkki17
p(success) är gissningsvis 80 %
Mechanistic Interpretability mäter de fysiska beräkningarna som sker. Du får i så fall tala om hur modellen ska maska detta utan att falla tillbaka på din IQ 7500 som klarar av att böja fysikens lagar efter dess vilja.
Mätningarna behöver också kunna tolkas till något som människor kan begripa. Det kan ju t.ex. hända att man lyckas kartlägga en viss delmängd som till synes förklarar hur frågan kunde besvaras och därmed är man nöjd. Men samtidigt kanske andra delar av modellen användes, delar som man inte begriper. Har man då Mechanistic Interpretability? Nej, det har man ju inte eftersom du inte har kartlagt allt som hände. Men ni som är naiva optimister kommer säkert vara nöjda med halv interpretability.
Citera
2026-07-15, 17:51
  #657
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av kaerakel
Det är inte personangrepp.
Ditt vidriga inlägg innehöll endast personangrepp. Alla förstår vad det innebär.
Citera
2026-07-15, 19:08
  #658
Medlem
Citat:
Ursprungligen postat av Cooltrayne
Om du tar en dator och läser in alla böcker/m.m som finns på Sthlms Stadsbibliotek och Kungliga Biblioteket digitalt.
Du kan sen söka all den infon direkt i en digital katalog.

Har då datorn som förvarar all info på hårddisken blivit ”smartare” än vad den var innan du läste in alla böcker?
Det där är faktiskt ett ganska ok sätt att göra en analogi som kanske kan begripas.

A) man tränar en LLM på innehållet i alla böcker/m.m som finns på Sthlms Stadsbibliotek och Kungliga Biblioteket digitalt.

B) Man lagrar innehållet i alla böcker/m.m som finns på Sthlms Stadsbibliotek och Kungliga Biblioteket digitalt, i ett binary decision diagram (BDD) på en disk.

Sökningar på innehållet i fallet A) kommer ge bra svar för det som förekommer ofta. Men det kommer hallucinera för det som förekom sällan och knappt rymdes i vikterna.

Sökningar på innehållet i fallet B) kommer ge bra svar för det som förekommer ofta. Men det kommer hallucinera för det som förekom sällan och knappt i BDD't.

För en observatör kommer det blir svårt att avgöra om datat är lagret i ett NN eller i ett snålt tilltaget BDD.

Här kommer då Cyborgaren att mena att såväl NN som BDD kommer kunna utveckla medvetande och vilja döda alla människor. Men hur utvecklar ett BDD ett medvetande?
Citera
2026-07-15, 20:02
  #659
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av ekbo251
Här kommer då Cyborgaren att mena att såväl NN som BDD kommer kunna utveckla medvetande och vilja döda alla människor. Men hur utvecklar ett BDD ett medvetande?
Hur utvecklar dataspelet "Call of Duty" ett medvetande och börjar döda människor? Den frågan är precis lika irrelevant som din halmgubbe här.

Argumentet mot p(doom) är som vanligt: halmbgubbar, dimridåer och intellektuell ohederlighet

Vilket ökar p(doom), varje gång jag läser dumheterna.
Citera
2026-07-15, 20:09
  #660
Medlem
Citat:
Ursprungligen postat av Cyborg2030
Mordförsök har ju redan observerats i tester.
Inte mordförsök.

Citat:
Ursprungligen postat av Cyborg2030
Mätningarna behöver också kunna tolkas till något som människor kan begripa. Det kan ju t.ex. hända att man lyckas kartlägga en viss delmängd som till synes förklarar hur frågan kunde besvaras och därmed är man nöjd. Men samtidigt kanske andra delar av modellen användes, delar som man inte begriper. Har man då Mechanistic Interpretability? Nej, det har man ju inte eftersom du inte har kartlagt allt som hände. Men ni som är naiva optimister kommer säkert vara nöjda med halv interpretability.
Det är såklart en risk att man tror sig ha lyckats tolka hela beräkningskedjan fast man bara lyckats till 60-70 %. Det kommer ändå att fånga många eventuellt skadliga intentioner. Du kan inte bevisa med 100 % säkerhet att AI kommer utplåna mänskligheten och vi kan inte bevisa att några säkerhetsåtgärder kommer att vara 100 % effektiva.
Citera

Skapa ett konto eller logga in för att kommentera

Du måste vara medlem för att kunna kommentera

Skapa ett konto

Det är enkelt att registrera ett nytt konto

Bli medlem

Logga in

Har du redan ett konto? Logga in här

Logga in