Created bymario-alka.dePowered bygodcore.denoob2claw.detricoma.de
Contributed byMario AlkaMistral AI

Codestral-22B-v0.1

Performance benchmark · measured on 22.07.2026 16:20

Benchmark-IDrun-20260722-162021-24c74a
Dense22BRuntime: vLLM
Generation80,00tok/s
Prefill1.200,00tok/s
Time to First Token150,00ms
Total duration60,00s
Concurrency8parallel
Ranking in the field
1of 1 systems

Performance benchmark · Primary metric: Generation-Speed (tok/s) · 8× concurrent

This run is better than 100 % of all comparable systems.
Generation 80,0 tok/s
+0 % vs Ø 80,0
Prefill 1.200,0 tok/s
+0 % vs Ø 1.200,0
Time to First Token 150 ms
+0 % vs Ø 150

Wie schlägt sich dieser Benchmark mit anderen Modellen?

Hardware

GPU: NVIDIA GB10
CPU: AMD Ryzen 9 9950X 16-Core Processor
RAM: 128 GB

Setup

Runtime: vLLM
Quantization: -
Driver: NVIDIA 580.159.03 / CUDA 13.0
Model: Codestral-22B-v0.1

All benchmarks of this model To leaderboard

Anzeige
Model comparison

Codestral-22B-v0.1 on various hardware

All published performance runs of this model – each bubble a variant: position = prefill (X) × generation (Y), bubble size = number of runs. Closer to the top right = faster. ★ Marked gold = this benchmark.

GPUby graphics card

8296224152070,002.6575.3147.970Prefill (tok/s)Generation (tok/s)NVIDIA GeForce RTX 5090 - 641,4 tok/s Generation, 5.824 tok/s Prefill, TTFT 7.096 ms (3 Laufe)NVIDIA GeForce RTX 50...NVIDIA RTX PRO 6000 Blackwell Workstation Edition - 629,5 tok/s Generation, 5.700 tok/s Prefill, TTFT 6.905 ms (3 Laufe)NVIDIA RTX PRO 6000 B...NVIDIA RTX PRO 6000 Blackwell Max-Q Workstation Edition - 559,4 tok/s Generation, 6.460 tok/s Prefill, TTFT 8.205 ms (9 Laufe)NVIDIA RTX PRO 6000 B...NVIDIA GeForce RTX 3090 Ti - 325,2 tok/s Generation, 2.975 tok/s Prefill, TTFT 8.460 ms (9 Laufe)NVIDIA GeForce RTX 30...AMD Radeon AI PRO R9700 - 201,5 tok/s Generation, 2.324 tok/s Prefill, TTFT 14.356 ms (15 Laufe)AMD Radeon AI PRO R97...AMD Radeon PRO W7900 Dual Slot - 147,5 tok/s Generation, 1.589 tok/s Prefill, TTFT 10.455 ms (18 Laufe)AMD Radeon PRO W7900 ...NVIDIA GeForce RTX 5070 Ti - 62,9 tok/s Generation, 994 tok/s Prefill, TTFT 64.942 ms (3 Laufe)NVIDIA GeForce RTX 50...Intel Arc Pro B70 - 23,6 tok/s Generation, 300 tok/s Prefill, TTFT 7.630 ms (2 Laufe)Intel Arc Pro B70NVIDIA Tesla P100 PCIe 16GB - 22,2 tok/s Generation, 224 tok/s Prefill, TTFT 35.995 ms (2 Laufe)NVIDIA Tesla P100 PCI...NVIDIA GB10 (DGX Spark) - 80,0 tok/s Generation, 1.200 tok/s Prefill, TTFT 150 ms (1 Lauf) | DIESER LAUF★ NVIDIA GB10 (DGX Spar...
NVIDIA GeForce RTX 5090 641,4 tok/sNVIDIA RTX PRO 6000 Blackwell Workstation Edition 629,5 tok/sNVIDIA RTX PRO 6000 Blackwell Max-Q Workstation Edition 559,4 tok/sNVIDIA GeForce RTX 3090 Ti 325,2 tok/sAMD Radeon AI PRO R9700 201,5 tok/sAMD Radeon PRO W7900 Dual Slot 147,5 tok/s★ NVIDIA GB10 (DGX Spark) 80,0 tok/s this runNVIDIA GeForce RTX 5070 Ti 62,9 tok/sIntel Arc Pro B70 23,6 tok/sNVIDIA Tesla P100 PCIe 16GB 22,2 tok/s

CPUby processor

8296224152070,002.6545.3097.963Prefill (tok/s)Generation (tok/s)AMD Ryzen 7 5800X3D 8-Core Processor - 641,4 tok/s Generation, 5.824 tok/s Prefill, TTFT 7.096 ms (3 Laufe)AMD Ryzen 7 5800X3D 8...AMD Ryzen Threadripper PRO 9965WX 24-Cores - 559,4 tok/s Generation, 6.460 tok/s Prefill, TTFT 8.205 ms (9 Laufe)AMD Ryzen Threadrippe...AMD Ryzen 9 8945HX with Radeon Graphics - 325,2 tok/s Generation, 2.907 tok/s Prefill, TTFT 14.580 ms (3 Laufe)AMD Ryzen 9 8945HX wi...AMD Ryzen 5 5600X 6-Core Processor - 277,9 tok/s Generation, 3.010 tok/s Prefill, TTFT 5.401 ms (6 Laufe)AMD Ryzen 5 5600X 6-C...AMD Ryzen Threadripper PRO 7955WX 16-Cores - 201,5 tok/s Generation, 2.324 tok/s Prefill, TTFT 14.356 ms (15 Laufe)AMD Ryzen Threadrippe...AMD Ryzen Threadripper PRO 5975WX 32-Cores - 147,5 tok/s Generation, 1.504 tok/s Prefill, TTFT 18.239 ms (21 Laufe)AMD Ryzen Threadrippe...AMD Ryzen 9 7945HX with Radeon Graphics - 23,6 tok/s Generation, 262 tok/s Prefill, TTFT 21.813 ms (4 Laufe)AMD Ryzen 9 7945HX wi...AMD Ryzen 9 9950X 16-Core Processor - 629,5 tok/s Generation, 4.575 tok/s Prefill, TTFT 5.216 ms (4 Laufe) | DIESER LAUF★ AMD Ryzen 9 9950X 16-...
AMD Ryzen 7 5800X3D 8-Core Processor 641,4 tok/s★ AMD Ryzen 9 9950X 16-Core Processor 629,5 tok/s this runAMD Ryzen Threadripper PRO 9965WX 24-Cores 559,4 tok/sAMD Ryzen 9 8945HX with Radeon Graphics 325,2 tok/sAMD Ryzen 5 5600X 6-Core Processor 277,9 tok/sAMD Ryzen Threadripper PRO 7955WX 16-Cores 201,5 tok/sAMD Ryzen Threadripper PRO 5975WX 32-Cores 147,5 tok/sAMD Ryzen 9 7945HX with Radeon Graphics 23,6 tok/s

MBby mainboard

8296224152070,002.3944.7877.181Prefill (tok/s)Generation (tok/s)ASUSTeK COMPUTER INC. ROG STRIX B550-A GAMING - 641,4 tok/s Generation, 5.824 tok/s Prefill, TTFT 7.096 ms (3 Laufe)ASUSTeK COMPUTER INC....ASUSTeK COMPUTER INC. ProArt X870E-CREATOR WIFI - 629,5 tok/s Generation, 5.700 tok/s Prefill, TTFT 6.905 ms (3 Laufe)ASUSTeK COMPUTER INC....ASUSTeK COMPUTER INC. Pro WS WRX90E-SAGE SE - 559,4 tok/s Generation, 3.875 tok/s Prefill, TTFT 12.050 ms (24 Laufe)ASUSTeK COMPUTER INC....Meigao Innovation Technology (Shen Zhen) Co., Ltd DRFXL (MotherBoard Series) - 325,2 tok/s Generation, 2.907 tok/s Prefill, TTFT 14.580 ms (3 Laufe)Meigao Innovation Tec...ASUSTeK COMPUTER INC. PRIME A520M-K - 277,9 tok/s Generation, 3.010 tok/s Prefill, TTFT 5.401 ms (6 Laufe)ASUSTeK COMPUTER INC....ASUSTeK COMPUTER INC. Pro WS WRX80E-SAGE SE WIFI - 147,5 tok/s Generation, 1.504 tok/s Prefill, TTFT 18.239 ms (21 Laufe)ASUSTeK COMPUTER INC....unbekannt - 80,0 tok/s Generation, 1.200 tok/s Prefill, TTFT 150 ms (1 Lauf)unbekanntShenzhen Meigao Electronic Equipment Co.,Ltd DRFXI (MotherBoard Series) - 23,6 tok/s Generation, 300 tok/s Prefill, TTFT 7.630 ms (2 Laufe)Shenzhen Meigao Elect...Shenzhen Meigao Electronic Equipment Co.,Ltd F1FXM (DeskMini Series) - 22,2 tok/s Generation, 224 tok/s Prefill, TTFT 35.995 ms (2 Laufe)Shenzhen Meigao Elect...
ASUSTeK COMPUTER INC. ROG STRIX B550-A GAMING 641,4 tok/sASUSTeK COMPUTER INC. ProArt X870E-CREATOR WIFI 629,5 tok/sASUSTeK COMPUTER INC. Pro WS WRX90E-SAGE SE 559,4 tok/sMeigao Innovation Technology (Shen Zhen) Co., Ltd DRFXL (MotherBoard Series) 325,2 tok/sASUSTeK COMPUTER INC. PRIME A520M-K 277,9 tok/sASUSTeK COMPUTER INC. Pro WS WRX80E-SAGE SE WIFI 147,5 tok/sunbekannt 80,0 tok/sShenzhen Meigao Electronic Equipment Co.,Ltd DRFXI (MotherBoard Series) 23,6 tok/sShenzhen Meigao Electronic Equipment Co.,Ltd F1FXM (DeskMini Series) 22,2 tok/s

ENGby engine

79160942824664,51.7532.2882.8223.357Prefill (tok/s)Generation (tok/s)llama.cpp - 641,4 tok/s Generation, 3.012 tok/s Prefill, TTFT 15.202 ms (55 Laufe)llama.cppunbekannt - 214,1 tok/s Generation, 2.099 tok/s Prefill, TTFT 3.660 ms (7 Laufe)unbekanntvLLM - 277,9 tok/s Generation, 2.613 tok/s Prefill, TTFT 5.336 ms (3 Laufe) | DIESER LAUF★ vLLM
llama.cpp 641,4 tok/s★ vLLM 277,9 tok/s this rununbekannt 214,1 tok/s

DRVby driver

8296224152070,001.2652.5303.794Prefill (tok/s)Generation (tok/s)unbekannt - 641,4 tok/s Generation, 3.104 tok/s Prefill, TTFT 14.462 ms (59 Laufe)unbekanntAMD 7.0.0-27-generic - 33,5 tok/s Generation, 1.090 tok/s Prefill, TTFT 3.025 ms (3 Laufe)AMD 7.0.0-27-genericIntel 26.18.38308.4 - 23,6 tok/s Generation, 300 tok/s Prefill, TTFT 7.630 ms (2 Laufe)Intel 26.18.38308.4NVIDIA 580.159.03 / CUDA 13.0 - 80,0 tok/s Generation, 1.200 tok/s Prefill, TTFT 150 ms (1 Lauf) | DIESER LAUF★ NVIDIA 580.159.03 / C...
unbekannt 641,4 tok/s★ NVIDIA 580.159.03 / CUDA 13.0 80,0 tok/s this runAMD 7.0.0-27-generic 33,5 tok/sIntel 26.18.38308.4 23,6 tok/s
💰 Economics

Economics of this run

Operating cost, TCO and comparison with the next-best runs of the same model at identical concurrency (8× concurrent). Methodology →

⚙️ ConfigurationAll metrics and charts below follow these settings – based on a 24-month runtime.Save to URLReset
⚡ Electricity price EUR/kWh
⚙️ System utilization 100 %
🖥️ Acquisition EUR
🔌 Idle 15 W
⚡ TDP 140 W
☁️ External LLM (API)
Electricity0.30 EUR/kWh
Avg power (incl. idle)140 W estimated (TDP)GPU 140 W full load
Avg cost / hourEUR 0.042
Electricity / 1M tokensEUR 0.15
Token / kWh2.06M
Acquisition (system)EUR 4,769 partial priceGPU EUR 4,000 · CPU EUR 649 · PSU EUR 120
Electricity (2 years)
TCO (2 years)EUR 5,505
Output tokens (2 years)5.05B
☁️ External LLM (API) – comparison
External LLM cost (2 years)
Savings vs. external (2 years)

All values above and the charts below take the configured system utilization into account: at X% the system generates only X% of the time, the rest it idles (15 W). Cost per hour drops (more idle), cost per token rises.

Cost over 2 years – electricity only

Cost over 2 years – incl. acquisition (TCO)

Speed vs. tokens per euro

Euro per 1M tokens

Comparison vs. API – economics per benchmark

Codestral-22B-v0.1NVIDIA GB10 (DGX Spark)
Electricity cost (24 mo.)
Acquisition cost
Total cost (TCO)
Generated tokens (24 mo.)
Token price via API
Break-even point (days)
Result (savings / extra cost)

Comparison with up to 3 next-best runs of this model at the same concurrency (at least one on different hardware). Power = GPU TDP + CPU (idle + 15 %) + board (estimated), acquisition = full system (GPU + CPU + board + RAM + PSU), prices = stored market prices.

Contributed by

Mario Alka Administrator

@marioalka

Ich bin Unternehmer, Softwareentwickler und KI-Enthusiast. Seit vielen Jahren entwickle ich Unternehmenssoftware und beschäftige mich inzwischen fast täglich mit lokalen LLMs, KI-Agenten und leistungsfähiger KI-Hardware.

Mit LLM-Benchmark.de möchte ich eine Plattform schaffen, auf der Modelle, GPUs und Agenten objektiv und reproduzierbar miteinander verglichen werden.