2026-08-19, 11:31
  #1
Medlem
Tom.Of.Finlands avatar
Hur många TOPS på en NPU (Neural Processing Unit) bör man ha om man vill kunna köra lokala modeller?
Citera
2026-08-19, 12:35
  #2
Medlem
Citat:
Ursprungligen postat av Tom.Of.Finland
Hur många TOPS på en NPU (Neural Processing Unit) bör man ha om man vill kunna köra lokala modeller?

TOPS är väl inte relevant när man ska köra en färdig lokal modell?

Det är VRAM och bandbredd på VRAM som spelar roll.

Hittade en sammanställning - vet inte om den stämmer men den ger iaf en slags förklaring:

3B (Tiny) - Llama 3.2 3B, Phi-3.5 Mini - 8GB - 16GB + 4-core CPU
7B (Small) Mistral 7B, Llama 3.2 7B 12GB 16GB + GPU (8GB)
13B (Medium) Llama 2 13B, Mixtral 8x7B 24GB 32GB + GPU (12GB)
34B (Large) CodeLlama 34B, Yi 34B 48GB 64GB + GPU (16GB)
70B+ (Huge) Llama 3.1 70B, Qwen 72B 96GB 128GB + GPU (24GB)

Vill du köra en 34B modell så rekommenderas alltså 48 Gb RAM och en GPU med 16GB VRAM.

Vill du köra en modell med 70B så rekommenderas 96 GB RAM och 24 GB VRAM.
__________________
Senast redigerad av poiuy1298 2026-08-19 kl. 12:38.
Citera
2026-08-19, 17:02
  #3
Medlem
Tom.Of.Finlands avatar
Citat:
Ursprungligen postat av poiuy1298
TOPS är väl inte relevant när man ska köra en färdig lokal modell?

Det är VRAM och bandbredd på VRAM som spelar roll.

Hittade en sammanställning - vet inte om den stämmer men den ger iaf en slags förklaring:

3B (Tiny) - Llama 3.2 3B, Phi-3.5 Mini - 8GB - 16GB + 4-core CPU
7B (Small) Mistral 7B, Llama 3.2 7B 12GB 16GB + GPU (8GB)
13B (Medium) Llama 2 13B, Mixtral 8x7B 24GB 32GB + GPU (12GB)
34B (Large) CodeLlama 34B, Yi 34B 48GB 64GB + GPU (16GB)
70B+ (Huge) Llama 3.1 70B, Qwen 72B 96GB 128GB + GPU (24GB)

Vill du köra en 34B modell så rekommenderas alltså 48 Gb RAM och en GPU med 16GB VRAM.

Vill du köra en modell med 70B så rekommenderas 96 GB RAM och 24 GB VRAM.

Med andra ord så behöver man en äckligt snabb dator om man vill köra lokala modeller....
Citera
2026-08-19, 17:40
  #4
Medlem
Citat:
Ursprungligen postat av Tom.Of.Finland
Med andra ord så behöver man en äckligt snabb dator om man vill köra lokala modeller....

Behöver inte vara så snabb men du behöver mycket VRAM. Det går nog att bygga ihop något för 10-20k om man använder begagnade GPU:s av äldre modell (men med mycket VRAM).

Beroende på hur mycket du ska använda den så kan det bli billigare med att hyra en ny super-duper-GPU från Nvidia - typ H100.

https://vast.ai/pricing/gpu/H100-PCIE?srsltid=AfmBOorhSwm1SSVKHYNu8GfQ5wUhChPmjjSLg fegdzfbpRnhBjRUix-P

Då kommer det gå snabbt.
Citera
2026-08-19, 20:05
  #5
Medlem
Tom.Of.Finlands avatar
Citat:
Ursprungligen postat av poiuy1298
Behöver inte vara så snabb men du behöver mycket VRAM. Det går nog att bygga ihop något för 10-20k om man använder begagnade GPU:s av äldre modell (men med mycket VRAM).

Beroende på hur mycket du ska använda den så kan det bli billigare med att hyra en ny super-duper-GPU från Nvidia - typ H100.

https://vast.ai/pricing/gpu/H100-PCIE?srsltid=AfmBOorhSwm1SSVKHYNu8GfQ5wUhChPmjjSLg fegdzfbpRnhBjRUix-P

Då kommer det gå snabbt.

Då vet jag denna prissumma! Tackar för svar!

Låter dyrt idag. Kanske blir billigare i framtiden, men då är modellerna för dåliga.
Citera
2026-08-19, 21:30
  #6
Medlem
insertrandomnames avatar
Citat:
Ursprungligen postat av Tom.Of.Finland
Då vet jag denna prissumma! Tackar för svar!

Låter dyrt idag. Kanske blir billigare i framtiden, men då är modellerna för dåliga.

Vet inte hur priserna ser ut just nu, men gamla 3060 12 GB var ett bra tips tidigare.
Citera

Skapa ett konto eller logga in för att kommentera

Du måste vara medlem för att kunna kommentera

Skapa ett konto

Det är enkelt att registrera ett nytt konto

Bli medlem

Logga in

Har du redan ett konto? Logga in här

Logga in