💰
LLM Economics
LLM Economics
Vergleiche Hardware, Modelle und Inferenz-Setups nach Betriebskosten, Tokenleistung und Gesamtbetriebskosten.
💸 Betriebskosten🖥️ TCO⚡ Token / Euro🔋 Token / kWh
Einstellungen werden im Browser gespeichert und in der URL geteilt. Leistungsaufnahme ist mangels Messwert je Lauf aus GPU-TDP × Anzahl (geschätzt) hinterlegt. Methodik →
Modell-Wirtschaftlichkeit
52 Modelle
Wirtschaftlichstes Setup je Modell. Kein Qualitätsurteil – nur gemessene Kosten pro Token. Zahl hinter dem Modell = Läufe · HW-Konfigurationen.
| # | Modell | Hersteller | Parameter | Gen tok/s i | € / 1 Mio. Tok i | Tok/€ | Tok/kWh | günstigste HW |
|---|---|---|---|---|---|---|---|---|
| 1 | MiniMax-M2.7-AWQ-4biti | MiniMax | 230B | 86,6 | 0,067 EUR | 14,93 Mio. | 4,48 Mio. | NVIDIA GB10 (DGX Spark) |
| 2 | Meta-Llama-3.1-8B-Instructi | Meta | 8B | 66,7 | 0,24 EUR | 4,17 Mio. | 1,25 Mio. | AMD Radeon 8060S Graphics |
| 3 | Nemotron-Cascade-2-30B-A3Bi | NVIDIA | 30B | 145,7 | 0,17 EUR | 5,72 Mio. | 1,72 Mio. | AMD Radeon 8060S Graphics |
| 4 | Qwen3-VL-30B-A3B-Instructi | Qwen (Alibaba) | 30B | 326,5 | 0,067 EUR | 14,87 Mio. | 4,46 Mio. | NVIDIA RTX PRO 6000 Blackwell Workstation Edition |
| 5 | Nemotron-3-Nano-Omni-30B-A3B-Reasoningi | NVIDIA | 30B | 144,1 | 0,18 EUR | 5,62 Mio. | 1,69 Mio. | AMD Radeon 8060S Graphics |
| 6 | NVIDIA-Nemotron-3-Nano-4Bi | NVIDIA | 4B | 143,2 | 0,18 EUR | 5,67 Mio. | 1,70 Mio. | AMD Radeon 8060S Graphics |
| 7 | North-Mini-Code-1.0i | Cohere | – | 148,0 | 0,15 EUR | 6,60 Mio. | 1,98 Mio. | AMD Radeon 8060S Graphics |
| 8 | NVIDIA-Nemotron-3-Nano-30B-A3Bi | NVIDIA | 30B | 144,1 | 0,17 EUR | 5,85 Mio. | 1,76 Mio. | AMD Radeon 8060S Graphics |
| 9 | Qwen-AgentWorld-35B-A3Bi | Qwen (Alibaba) | 35B | 108,6 | 0,19 EUR | 5,19 Mio. | 1,56 Mio. | AMD Radeon 8060S Graphics |
| 10 | Qwen2.5-32B-Instruct-AWQi | Qwen (Alibaba) | 32B | 155,9 | 0,14 EUR | 7,38 Mio. | 2,21 Mio. | NVIDIA RTX PRO 6000 Blackwell Workstation Edition |
| 11 | NVIDIA-Nemotron-3-Nano-30B-A3B-BF16i | NVIDIA | – | 236,1 | 0,13 EUR | 7,71 Mio. | 2,31 Mio. | NVIDIA RTX PRO 6000 Blackwell Workstation Edition |
| 12 | Qwen3-Omni-30B-A3B-Thinkingi | Qwen (Alibaba) | 30B | 342,3 | 0,076 EUR | 13,17 Mio. | 3,95 Mio. | NVIDIA RTX PRO 6000 Blackwell Workstation Edition |
| 13 | Qwen3.6-27Bi | Qwen (Alibaba) | 27B | 25,7 | 0,55 EUR | 1,80 Mio. | 540,90 Tsd. | AMD Radeon 8060S Graphics |
| 14 | gpt-oss-20bi | OpenAI | 21B | 302,2 | 0,043 EUR | 23,21 Mio. | 6,96 Mio. | NVIDIA GeForce RTX 5090 |
| 15 | Qwen3-30B-A3B-Instruct-2507i | Qwen (Alibaba) | 30B | 251,2 | 0,049 EUR | 20,61 Mio. | 6,18 Mio. | NVIDIA GeForce RTX 3090 Ti |
| 16 | Qwen3-Coder-30B-A3B-Instructi | Qwen (Alibaba) | 30B | 251,0 | 0,062 EUR | 16,17 Mio. | 4,85 Mio. | NVIDIA GeForce RTX 5090 |
| 17 | MiniMax-M2.5i | MiniMax | 230B | 62,7 | 1,66 EUR | 601,92 Tsd. | 180,58 Tsd. | 3× NVIDIA RTX PRO 6000 Blackwell Max-Q Workstation Edition |
| 18 | Qwen3.5-35B-A3Bi | Qwen (Alibaba) | 35B | 230,9 | 0,067 EUR | 14,87 Mio. | 4,46 Mio. | NVIDIA RTX PRO 6000 Blackwell Workstation Edition |
| 19 | Ministral-3-14B-Reasoning-2512i | Mistral AI | 14B | 236,6 | 0,068 EUR | 14,78 Mio. | 4,43 Mio. | NVIDIA GeForce RTX 5090 |
| 20 | Qwen3-30B-A3B-Thinking-2507i | Qwen (Alibaba) | 30B | 253,2 | 0,050 EUR | 20,20 Mio. | 6,06 Mio. | NVIDIA GeForce RTX 3090 Ti |
| 21 | Magistral-Small-2509i | Mistral AI | 24B | 218,3 | 0,070 EUR | 14,21 Mio. | 4,26 Mio. | NVIDIA GeForce RTX 5090 |
| 22 | Qwen3.6-35B-A3Bi | Qwen (Alibaba) | 35B | 232,5 | 0,070 EUR | 14,29 Mio. | 4,29 Mio. | NVIDIA GeForce RTX 5090 |
| 23 | Laguna-XS-2.1-INT4i | Poolside | – | 90,0 | 0,72 EUR | 1,39 Mio. | 417,55 Tsd. | 3× AMD Radeon AI PRO R9700 |
| 24 | Devstral-Small-2-24B-Instruct-2512i | Mistral AI | 24B | 231,6 | 0,065 EUR | 15,48 Mio. | 4,64 Mio. | NVIDIA GeForce RTX 5090 |
| 25 | Codestral-22B-v0.1i | Mistral AI | 22B | 230,3 | 0,063 EUR | 15,82 Mio. | 4,75 Mio. | NVIDIA GeForce RTX 5090 |
| 26 | Seed-OSS-36B-Instructi | ByteDance Seed | – | 38,6 | 0,47 EUR | 2,15 Mio. | 644,85 Tsd. | AMD Radeon 8060S Graphics |
| 27 | OpenReasoning-Nemotron-32Bi | NVIDIA | 32B | 32,0 | 0,95 EUR | 1,05 Mio. | 316,20 Tsd. | AMD Radeon 8060S Graphics |
| 28 | Devstral-Small-2507i | Mistral AI | 24B | 209,6 | 0,062 EUR | 16,05 Mio. | 4,81 Mio. | NVIDIA GeForce RTX 5090 |
| 29 | gpt-oss-120bi | OpenAI | 117B | 265,7 | 0,071 EUR | 14,18 Mio. | 4,25 Mio. | NVIDIA GeForce RTX 5090 |
| 30 | Qwen3-Coder-Nexti | Qwen (Alibaba) | – | 78,6 | 0,71 EUR | 1,41 Mio. | 423,20 Tsd. | 3× AMD Radeon AI PRO R9700 |
| 31 | Mistral-Small-3.1-24B-Instruct-2503i | Mistral AI | 24B | 189,5 | 0,071 EUR | 14,11 Mio. | 4,23 Mio. | NVIDIA GeForce RTX 5090 |
| 32 | gemma-4-E4B-iti | 4B | 51,3 | 0,25 EUR | 3,99 Mio. | 1,20 Mio. | AMD Radeon 8060S Graphics | |
| 33 | GLM-4.5-Airi | Z.ai (Zhipu) | 106B | 257,7 | 0,061 EUR | 16,35 Mio. | 4,90 Mio. | NVIDIA GeForce RTX 5090 |
| 34 | gemma-4-12B-iti | 12B | 48,5 | 0,25 EUR | 3,98 Mio. | 1,19 Mio. | AMD Radeon 8060S Graphics | |
| 35 | gemma-4-E2B-iti | 2B | 49,2 | 0,25 EUR | 3,97 Mio. | 1,19 Mio. | AMD Radeon 8060S Graphics | |
| 36 | Gemma-4-26B-A4B-iti | 26B | 49,1 | 0,17 EUR | 5,98 Mio. | 1,79 Mio. | AMD Radeon 8060S Graphics | |
| 37 | Llama-3_3-Nemotron-Super-49B-v1_5i | NVIDIA | 49B | 21,0 | 1,40 EUR | 713,00 Tsd. | 213,90 Tsd. | AMD Radeon 8060S Graphics |
| 38 | gemma-4-31B-iti | 31B | 48,3 | 0,25 EUR | 4,02 Mio. | 1,21 Mio. | AMD Radeon 8060S Graphics | |
| 39 | Qwen2.5-Coder-32B-Instructi | Qwen (Alibaba) | 32B | 224,4 | 0,046 EUR | 21,89 Mio. | 6,57 Mio. | NVIDIA GeForce RTX 5090 |
| 40 | Laguna-S-2.1-INT4i | Poolside | – | 42,0 | 1,57 EUR | 636,18 Tsd. | 190,85 Tsd. | 3× AMD Radeon AI PRO R9700 |
| 41 | gemma-4-26B-A4B-it-assistanti | 26B | 38,6 | 0,27 EUR | 3,73 Mio. | 1,12 Mio. | AMD Radeon 8060S Graphics | |
| 42 | Nemotron-H-47B-Reasoning-128Ki | NVIDIA | 47B | 12,6 | 1,88 EUR | 533,00 Tsd. | 159,90 Tsd. | AMD Radeon 8060S Graphics |
| 43 | Mistral-Small-4-119B-2603i | Mistral AI | 119B | 32,1 | 1,89 EUR | 528,00 Tsd. | 158,40 Tsd. | 3× AMD Radeon AI PRO R9700 |
| 44 | Step-3.5-Flashi | StepFun | – | 22,6 | 3,51 EUR | 285,11 Tsd. | 85,53 Tsd. | 3× AMD Radeon AI PRO R9700 |
| 45 | gemma-4-31b-it-int8i | 31B | 14,6 | 4,55 EUR | 219,79 Tsd. | 65,94 Tsd. | 3× AMD Radeon AI PRO R9700 | |
| 46 | Minimax-2.5i | MiniMax | 230B | 13,8 | 6,05 EUR | 165,38 Tsd. | 49,62 Tsd. | 3× AMD Radeon AI PRO R9700 |
| 47 | Mistral-Medium-3.5-128Bi | Mistral AI | 128B | 13,9 | 5,24 EUR | 190,92 Tsd. | 57,28 Tsd. | 3× AMD Radeon AI PRO R9700 |
| 48 | DeepSeek-V4-Flash-284B-A13Bi | DeepSeek | – | 15,5 | 4,98 EUR | 200,93 Tsd. | 60,28 Tsd. | 3× AMD Radeon AI PRO R9700 |
| 49 | command-a-reasoning-08-2025i | Cohere | – | 7,8 | 14,19 EUR | 70,47 Tsd. | 21,14 Tsd. | 3× AMD Radeon AI PRO R9700 |
| 50 | MiniMax-M2.7i | MiniMax | 230B | 12,2 | 6,55 EUR | 152,57 Tsd. | 45,77 Tsd. | 3× AMD Radeon AI PRO R9700 |
| 51 | Devstral-2-123B-Instruct-2512i | Mistral AI | 123B | 6,5 | 17,05 EUR | 58,65 Tsd. | 17,59 Tsd. | 3× AMD Radeon AI PRO R9700 |
| 52 | NVIDIA-Nemotron-3-Super-120B-A12Bi | NVIDIA | 120B | 15,2 | 4,76 EUR | 210,23 Tsd. | 63,07 Tsd. | 3× AMD Radeon AI PRO R9700 |
Niedrige Tokenkosten bedeuten nicht automatisch hohe Modellqualität. Für Qualität siehe Harness-Benchmarks.
