Vilket grafikkort behöver du för att köra AI lokalt? (uppmätt, 2026)
ornith:35b helt i grafikminnet i 156.5 tokens/s. 16 GB räcker till 8–14B-modeller, 12 GB till 8B-klassen. Priser på korten uppdateras dagligen nedan.Så snabbt går det på ett 24 GB-kort (NVIDIA GeForce RTX 3090)
Vi mäter alla våra 17 textmodeller på samma prompt och samma maskin (mätningen 22 september 2026, Ollama 0.34.0).
11 av 17 modeller får plats helt i grafikminnet. Snabbast är qwen3:30b-a3b med 189.6 tokens/s;
den största som ryms helt är ornith:35b (21.75 GB VRAM vid körning, 156.5 tok/s).
| Modell | Parametrar | Kvant | Disk (GB) | VRAM vid körning (GB) | Helt i VRAM | Genererar (tok/s) | Läser prompt (tok/s) | GPU-effekt medel (W) |
|---|---|---|---|---|---|---|---|---|
qwen3:30b-a3b | 30.5B | Q4_K_M | 18.6 | 21.72 | ✔ | 189.6 | 289.7 | 152.3 |
laguna-xs-2.1:latest | 33.4B | Q4_K_M | 20.3 | 20.42 | ✔ | 180.0 | 242.7 | 138.4 |
north-mini-code-1.0:latest | 30.5B | Q4_K_M | 18.6 | 19.09 | ✔ | 177.1 | 295.7 | 150.8 |
ornith:35b | 34.7B | Q4_K_M | 21.2 | 21.75 | ✔ | 156.5 | 400.8 | 150.3 |
qwen3:8b | 8.2B | Q4_K_M | 5.2 | 9.97 | ✔ | 129.4 | 389.0 | 212.9 |
nemotron-3-nano:30b | 31.6B | Q4_K_M | 24.3 | 22.74 | ✘ | 119.3 | 200.2 | 121.9 |
nemotron-3.5-lightning:latest | 32.9B | Q4_K_M | 25.4 | 21.38 | ✘ | 99.6 | 191.9 | 116.6 |
gemma3:12b | 12.2B | Q4_K_M | 8.1 | 8.07 | ✔ | 82.5 | 251.3 | 250.3 |
Hela tabellen med alla modeller: uppmätt lista. Rådata: benchmark.json.
Vad betyder det när du väljer kort
- VRAM först, sedan allt annat. Modellen måste rymmas i grafikminnet tillsammans med kontextfönstret. Det som inte ryms delas till vanligt RAM – i vår mätning föll de 6 modeller som inte rymdes till 7.9–119.3 tokens/s (t.ex.
huihui_ai/deepseek-r1-abliterated:32b-qwen-distill-q4_K_M), mot lägst 41.6 tok/s för dem som rymdes helt. Det är hela skillnaden mellan användbart och oanvändbart. - 24 GB:
qwen3:30b-a3b(189.6 tok/s),laguna-xs-2.1:latest(180.0 tok/s),north-mini-code-1.0:latest(177.1 tok/s),ornith:35b(156.5 tok/s),qwen3:8b(129.4 tok/s),gemma3:12b(82.5 tok/s),muse-glimmer:30b-q4_K_M-dflash(65.1 tok/s),qwen3.8:27b(55.8 tok/s),mistral-small:24b(52.9 tok/s),muse-glimmer:30b-q4_K_M(42.8 tok/s),hf.co/OBLITERATUS/Qwen3.8-27B-OBLITERATED:Q4_K_M(41.6 tok/s). - 16 GB (beräknat från uppmätt VRAM-behov, inte kört på ett 16 GB-kort):
qwen3:8b(129.4 tok/s),gemma3:12b(82.5 tok/s),muse-glimmer:30b-q4_K_M-dflash(65.1 tok/s). - 12 GB (beräknat):
qwen3:8b(129.4 tok/s),gemma3:12b(82.5 tok/s),muse-glimmer:30b-q4_K_M-dflash(65.1 tok/s). - 32 GB (beräknat från total storlek vid körning): allt ovan plus
nemotron-3-nano:30b,nemotron-3.5-lightning:latest,gemma4:31b,qwen2.5-coder:32b,deepseek-r1:32b,huihui_ai/deepseek-r1-abliterated:32b-qwen-distill-q4_K_M– de som i dag spiller till RAM hos oss. Det enda konsumentkortet med 32 GB är RTX 5090.
Observera att VRAM vid körning är större än filen på disk: Ollama lägger till kontextminne (KV-cache) och overhead. Se VRAM-guiden för uppmätta kvoter.
Vad korten kostar i dag
Priser hämtas automatiskt varje morgon från butikernas produktsidor (datum i tabellen). AMD-kort fungerar i Ollama via ROCm/Vulkan men stödet varierar per modell – kontrollera Ollamas lista innan köp (källa nedan).
GeForce RTX 5060 Ti 16 GB
Lägst i dag: 8 990 kr hos Proshop (hämtat 22 september 2026)
| Butik | Pris | Lager | Hämtat | |
|---|---|---|---|---|
| Proshop ASUS GeForce RTX 5060 Ti DUAL OC - 16GB GDDR7 RAM - Grafikkort | 8 990 kr | i lager | 22 september 2026 | Se hos Proshop → |
| Inet Palit GeForce RTX 5060 Ti 16GB Infinity 3 | 9 390 kr | i lager | 22 september 2026 | Se hos Inet → |
| Webhallen Webhallen Config Core - R5 7500F / RTX 5060Ti 8GB / 16GB / 1TB / Win 1 | 14 990 kr | i lager | 22 september 2026 | Se hos Webhallen → |
| Amazon.se | se aktuellt pris hos butiken | 22 september 2026 | Se hos Amazon.se → |
GeForce RTX 5070 Ti 16 GB
Lägst i dag: 12 999 kr hos Webhallen (hämtat 22 september 2026)
| Butik | Pris | Lager | Hämtat | |
|---|---|---|---|---|
| Webhallen Gigabyte GeForce RTX 5070 Ti WINDFORCE SFF 16GB OC | 12 999 kr | slut | 22 september 2026 | Se hos Webhallen → |
| Inet Gigabyte GeForce RTX 5070 Ti 16GB Gaming OC | 13 490 kr | i lager | 22 september 2026 | Se hos Inet → |
| Proshop GIGABYTE GeForce RTX 5070 Ti AERO OC - 16GB GDDR7 RAM - Grafikkort | 14 990 kr | i lager | 22 september 2026 | Se hos Proshop → |
| Amazon.se | se aktuellt pris hos butiken | 22 september 2026 | Se hos Amazon.se → |
GeForce RTX 5080 16 GB
Lägst i dag: 18 999 kr hos Webhallen (hämtat 22 september 2026)
| Butik | Pris | Lager | Hämtat | |
|---|---|---|---|---|
| Webhallen ASUS Prime GeForce RTX 5080 16GB OC | 18 999 kr | i lager | 22 september 2026 | Se hos Webhallen → |
| Inet Gigabyte GeForce RTX 5080 16GB Aorus Master Ice | 19 199 kr | i lager | 22 september 2026 | Se hos Inet → |
| Proshop GIGABYTE GeForce RTX 5080 WindForce 3 OC - 16GB GDDR7 RAM - Grafikkort | 19 790 kr | i lager | 22 september 2026 | Se hos Proshop → |
| Amazon.se | se aktuellt pris hos butiken | 22 september 2026 | Se hos Amazon.se → |
GeForce RTX 5090 32 GB
Lägst i dag: 56 990 kr hos Proshop (hämtat 22 september 2026)
| Butik | Pris | Lager | Hämtat | |
|---|---|---|---|---|
| Proshop ASUS GeForce RTX 5090 TUF - 32GB GDDR7 RAM - Grafikkort | 56 990 kr | förbeställning | 22 september 2026 | Se hos Proshop → |
| Webhallen ASUS TUF Gaming GeForce RTX 5090 32GB | 58 990 kr | slut | 22 september 2026 | Se hos Webhallen → |
| Inet ASUS GeForce RTX 5090 32GB ProArt OC | 59 390 kr | i lager | 22 september 2026 | Se hos Inet → |
| Amazon.se | se aktuellt pris hos butiken | 22 september 2026 | Se hos Amazon.se → |
Radeon RX 9070 XT 16 GB
Lägst i dag: 8 499 kr hos Inet (hämtat 22 september 2026)
| Butik | Pris | Lager | Hämtat | |
|---|---|---|---|---|
| Inet Gigabyte Radeon RX 9070 XT 16GB Aorus Elite | 8 499 kr | i lager | 22 september 2026 | Se hos Inet → |
| Webhallen Gigabyte Radeon RX 9070 XT AORUS ELITE 16GB | 8 999 kr | slut | 22 september 2026 | Se hos Webhallen → |
| Proshop PowerColor Radeon RX 9070 XT Reaper - 16GB GDDR6 RAM - Grafikkort | 9 690 kr | i lager | 22 september 2026 | Se hos Proshop → |
| Amazon.se | se aktuellt pris hos butiken | 22 september 2026 | Se hos Amazon.se → |
Radeon RX 7900 XTX 24 GB
Lägst i dag: 10 590 kr hos Webhallen (hämtat 22 september 2026)
| Butik | Pris | Lager | Hämtat | |
|---|---|---|---|---|
| Webhallen Sapphire PULSE RX 7900 XTX 24GB (Fyndvara klass 3) (Fyndvara klass 3) | 10 590 kr | 22 september 2026 | Se hos Webhallen → |
Vår tolkning efter mätningen
- Vill du köra 30B-klassen (som
qwen3:30b-a3b) lokalt i bra fart behöver du 24 GB. Ett begagnat RTX 3090 är den billigaste vägen dit – det är vad vi kör. - 16 GB räcker för 8–14B-modeller i hög fart; det är den bästa prislappen per token om du inte behöver de största modellerna.
- RTX 5090 (32 GB) köper du för längre kontext och större modeller, inte för att 8B-modeller ska gå fortare – de är redan snabba.
Vanliga frågor
Räcker 8 GB VRAM för att köra AI lokalt?
Med Ollamas standardinställningar tog qwen3:8b 9.97 GB VRAM i vår mätning, alltså mer än 8 GB. Med kortare kontextfönster går det att pressa ner, men 12 GB är den rimliga golvnivån för 8B-modeller.
Är ett begagnat RTX 3090 fortfarande värt det för lokal AI?
Det är kortet vi själva kör. 24 GB VRAM är fortfarande mer än något nytt kort under RTX 5090 har, och i vår mätning gav det 189.6 tokens/s på den snabbaste modellen. Nackdelen är strömförbrukningen – se elkostnaden.
Fungerar AMD-kort med Ollama?
Ja, via ROCm (och Vulkan i nyare versioner), men listan över stödda kort är kortare än för NVIDIA. Kontrollera Ollamas dokumentation för just den modell du tänker köpa. Våra mätningar är gjorda på NVIDIA.
Hur mäter ni tokens per sekund?
Samma prompt (256 genererade tokens) körs två gånger per modell via Ollamas API; vi tar den bästa körningen och läser eval_count/eval_duration ur svaret. VRAM läses från Ollamas /api/ps och effekten från nvidia-smi en gång per sekund under körningen.
Källor och metod
- Egen mätning 22 september 2026 på NVIDIA GeForce RTX 3090, AMD Ryzen 9 5950X 16-Core Processor, 64 GB RAM, Ollama 0.34.0. Rådata öppen: – https://hemmalabb.pages.dev/data/benchmark.json
- Ollama, stödda GPU:er (NVIDIA/AMD) – https://docs.ollama.com/gpu
- Priser: butikernas egna produktsidor, hämtade automatiskt med datum (se tabellerna). Rådata: – https://hemmalabb.pages.dev/data/priser.json