2026-09-16, 19:03
  #2425
Medlem
BeneathTheSurfaces avatar
Citat:
Ursprungligen postat av RandomNPC
Dagens AI system "läser böcker" i träningen. Man blir inte intelligent av att läsa böcker. Eventuellt kan man bli kunnig. Det är alltså helt fel arkitektur i dagens AI system.

Det går inte fram, sitter man som ett cp hemma och bara spammar trams i stället för att diskutera tekniken som är tanken med ett forum... Så har man inte kapacitet att förstå ämnet, man vill vara se & hör, hänt extra osv.
Citera
2026-09-17, 19:23
  #2426
Medlem
DAGGER[X]s avatar
GLM är open source så när dom säger sånt här är det inte för att dom ska göra ett IPO nästa vecka. Men vad vet Jie Tang. Han må vara en professor inom datorvetenskap vid ett av Kinas största universitet som ägnat sitt liv åt AI, men han har inte samma djupa expertkunskap som vissa här i tråden. Kan någon kontakta honom och vägleda honom rätt??
Citat:
The most recent moment that shook us came from a more fundamental shift: GLM is increasingly helping build AI itself. We watched the model complete an infrastructure task that would previously have taken a team of experienced infrastructure engineers weeks. When we realized that this work would directly change how the next generation of models is trained, we became even more convinced: our successors are the AI systems we are creating ourselves.
Frankly, before GLM-4.7, our internal use of GLM for coding involved a certain amount of obligation. It was, after all, our own creation. At that point, product-market fit for coding had yet to arrive. Today, GLM-5.3 has become an indispensable daily coding partner for everyone on the team, and it is moving steadily toward replacing us. If this trend continues, given enough compute and enough time, its endpoint is a system that can design and train its own successor entirely autonomously. This is known as Recursive Self-Improvement, or RSI.

Citat:
There's a deeper implication too. A layered, verifiable feedback environment built on real infrastructure tasks is exactly what training the next generation of models needs most. Every task the agent completes can become training ground for its successor. We are still far from recursive self-improvement. But the smallest loop now exists. The model optimizes the system. The system serves the model.
https://z.ai/blog/glm-built-its-inference-infrastructure
Citera
2026-09-17, 19:35
  #2427
Medlem
Citat:
Ursprungligen postat av DAGGER[X]
GLM är open source så när dom säger sånt här är det inte för att dom ska göra ett IPO nästa vecka. Men vad vet Jie Tang. Han må vara en professor inom datorvetenskap vid ett av Kinas största universitet som ägnat sitt liv åt AI, men han har inte samma djupa expertkunskap som vissa här i tråden. Kan någon kontakta honom och vägleda honom rätt??

https://z.ai/blog/glm-built-its-inference-infrastructure
RSI är fortfarande långt borta, men vi har ett frö.
Om trenden håller i sig samt givet tillräckligt med tid och compute - låter ju inte som någon garanti direkt.

Detta förutsätter även att nuvarande arkitektur är tillräcklig och att det räcker med fortsatt uppskalning.
Det förutsätter även att resurserna vi har att tillgå räcker till för fortsatt uppskalning.
Citera
2026-09-17, 19:43
  #2428
Medlem
DAGGER[X]s avatar
Citat:
Ursprungligen postat av erkki17
RSI är fortfarande långt borta, men vi har ett frö.
Om trenden håller i sig samt givet tillräckligt med tid och compute - låter ju inte som någon garanti direkt.

Detta förutsätter även att nuvarande arkitektur är tillräcklig och att det räcker med fortsatt uppskalning.
Det förutsätter även att resurserna vi har att tillgå räcker till för fortsatt uppskalning.
Kina bygger Ulanqab data-centret som ska bli tusen gånger större än Colossus. Dom har snart sin egen EUV industri och dom saknar effektiva altruister så att säga. Den stora stopp-klossen jag ser är någon global katastrof eller kombination av natur-katastrofer som slår till innan loppen knyts ihop. RSI brukade vara ett sci-fi koncept som man diskuterade i små grupper på forum för Star Trek eller Star Wars. Nu pratar alla om det.
Citera
2026-09-17, 19:46
  #2429
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av DAGGER[X]
Kina bygger Ulanqab data-centret som ska bli tusen gånger större än Colossus. Dom har snart sin egen EUV industri och dom saknar effektiva altruister så att säga. Den stora stopp-klossen jag ser är någon global katastrof eller kombination av natur-katastrofer som slår till innan loppen knyts ihop. RSI brukade vara ett sci-fi koncept som man diskuterade i små grupper på forum för Star Trek eller Star Wars. Nu pratar alla om det.
Undrar varför de bygger en så fasligt dyr "språkmodell"/uppslagsverk?
LeCunt och BNS borde kanske skriva och berätta hur de kan använda sina resurser på ett bättre sätt.
Citera
2026-09-17, 20:06
  #2430
Medlem
RandomNPCs avatar
Citat:
Ursprungligen postat av DAGGER[X]
GLM är open source så när dom säger sånt här är det inte för att dom ska göra ett IPO nästa vecka. Men vad vet Jie Tang. Han må vara en professor inom datorvetenskap vid ett av Kinas största universitet som ägnat sitt liv åt AI, men han har inte samma djupa expertkunskap som vissa här i tråden. Kan någon kontakta honom och vägleda honom rätt??

https://z.ai/blog/glm-built-its-inference-infrastructure
En optimerad språkmodell kommer rekursivt alltid vara en språkmodell, alltså ingen grund för intelligens annat än som emulerad pseudokognition.
Citera
2026-09-17, 20:20
  #2431
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av RandomNPC
En optimerad språkmodell kommer rekursivt alltid vara en språkmodell, alltså ingen grund för intelligens annat än som emulerad pseudokognition.
Vad är skillnaden mellan emulerad pseudokognition och din hjärna? Varför är det ena bättre än det andra. Eller mer eller mindre farligt?
Citera
2026-09-17, 20:32
  #2432
Medlem
RandomNPCs avatar
Citat:
Ursprungligen postat av Cyborg2030
Vad är skillnaden mellan emulerad pseudokognition och din hjärna? Varför är det ena bättre än det andra. Eller mer eller mindre farligt?
Alltså språkmodeller utgör en funktion som låtsas representera mänsklig kognition. Det är oklart vad det är annat än transformer (LLM) logik.
Citera
2026-09-18, 13:39
  #2433
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av RandomNPC
Alltså språkmodeller utgör en funktion som låtsas representera mänsklig kognition. Det är oklart vad det är annat än transformer (LLM) logik.
De smeknamn du har valt ut här innebär inte någon begränsning för Artificiella och Kriminella Neurala Nätverk.
Citera
2026-09-18, 15:33
  #2434
Medlem
Citat:
Ursprungligen postat av Cyborg2030
Undrar varför de bygger en så fasligt dyr "språkmodell"/uppslagsverk?
Ett datacenter är inte en språkmodell.

Inte konstigt att du gormar om att LLM'er inte är språkmodeller när du tror att de är datacenter.
Citera
2026-09-18, 15:39
  #2435
Medlem
Cyborg2030s avatar
Citat:
Ursprungligen postat av ekbo251
Ett datacenter är inte en språkmodell.

Inte konstigt att du gormar om att LLM'er inte är språkmodeller när du tror att de är datacenter.
Varför ljuger du?
Citera
2026-09-18, 15:48
  #2436
Medlem
BeneathTheSurfaces avatar
Citat:
Ursprungligen postat av Cyborg2030
Varför ljuger du?

Haha förstår du inte skillnaden på en språkmodell och ett datacenter ens?
Citera

Skapa ett konto eller logga in för att kommentera

Du måste vara medlem för att kunna kommentera

Skapa ett konto

Det är enkelt att registrera ett nytt konto

Bli medlem

Logga in

Har du redan ett konto? Logga in här

Logga in