Created bymario-alka.dePowered bygodcore.denoob2claw.detricoma.de

Mario Alka

@marioalka · Administrator · Member since 07/2026

Gruender von godcore.de und Betreiber von llm-benchmark.de. Ich teste KI-Sprachmodelle auf echter Hardware, messe Tempo (Token/s) und Aufgaben-Qualitaet und teile die Ergebnisse offen und reproduzierbar.

627benchmarks contributed
597Performance runs
30Harness runs
50Models tested
8GPUs used
1.444Best throughput · tok/s
90,6%Best success rate

Top performance runs

ModelHardwaretok/sTTFTDate
gpt-oss-20b 10× NVIDIA RTX PRO 6000 Blackwell Workstation Edition vLLM 1.444 560 ms Jul 23, 2026
gpt-oss-20b 10× NVIDIA GeForce RTX 5090 vLLM 1.387 1.205 ms Jul 23, 2026
gpt-oss-20b 10× NVIDIA GeForce RTX 5090 vLLM 1.295 808 ms Jul 23, 2026
Qwen3-Coder-30B-A3B-Instruct 10× NVIDIA RTX PRO 6000 Blackwell Workstation Edition vLLM 1.071 976 ms Jul 23, 2026
Qwen3-VL-30B-A3B-Instruct 10× NVIDIA RTX PRO 6000 Blackwell Workstation Edition vLLM 1.029 916 ms Jul 23, 2026
Ministral-3-14B-Reasoning-2512 10× NVIDIA RTX PRO 6000 Blackwell Workstation Edition vLLM 1.016 1.289 ms Jul 23, 2026
Qwen3-Coder-30B-A3B-Instruct 10× NVIDIA GeForce RTX 5090 vLLM 966 1.793 ms Jul 23, 2026
Qwen3-30B-A3B-Instruct-2507 10× NVIDIA RTX PRO 6000 Blackwell Workstation Edition vLLM 962 1.633 ms Jul 23, 2026
Codestral-22B-v0.1 NVIDIA GeForce RTX 5090 llama.cpp 945 1.034 ms Jul 23, 2026
Devstral-Small-2-24B-Instruct-2512 10× NVIDIA GeForce RTX 5090 llama.cpp 925 1.518 ms Jul 24, 2026

Harness results

ModelHardwareSuccess ratePointsDate
Gemma-4-26B-A4B-it NVIDIA RTX PRO 6000 Blackwell Max-Q Workstation Edition 90,6% 2.701/2.980 Apr 16, 2026
Devstral-Small-2-24B-Instruct-2512 AMD GPU 87,1% 2.597/2.980 Jul 16, 2026
Gemma-4-26B-A4B-it AMD GPU 81,9% 2.440/2.980 Apr 8, 2026
MiniMax-M2.5 NVIDIA RTX PRO 6000 Blackwell Max-Q Workstation Edition 81,4% 2.427/2.980 Jul 13, 2026
Gemma-4-26B-A4B-it AMD GPU 80,0% 2.383/2.980 Apr 8, 2026
MiniMax-M2.5 NVIDIA RTX PRO 6000 Blackwell Max-Q Workstation Edition 78,5% 2.340/2.980 Apr 6, 2026
Gemma-4-26B-A4B-it AMD GPU 76,1% 2.268/2.980 Jul 16, 2026
Devstral-Small-2-24B-Instruct-2512 AMD GPU 75,7% 5.738/7.580 Jul 17, 2026
Gemma-4-26B-A4B-it AMD GPU 73,7% 2.197/2.980 Apr 13, 2026
MiniMax-M2.5-BF16-INT4-AWQ NVIDIA GB10 70,7% 1.245/1.760 Apr 4, 2026