Created bymario-alka.dePowered bygodcore.denoob2claw.detricoma.de
🏆
Ranglisten

LLM Leaderboard

Reale Messergebnisse aller getesteten Sprachmodelle auf echter, benannter Hardware – bewertet nach roher Geschwindigkeit (Performance in Token pro Sekunde, Prefill und Zeit bis zum ersten Token) und nach praktischer Aufgaben-Qualität in vollständigen Agenten- und Chat-Abläufen (Harness). Wähle unten einen Benchmark-Typ oder filtere nach Modell, Hersteller und Hardware, um genau zu sehen, was jeweils geprüft wird und wie die Ergebnisse zustande kommen.

⚡ Performance (tok/s)🤖 Harness-Qualität👥 Concurrency🖥️ echte Hardware
Reset
Messwert:
#Modell / HerstellerMesswerteParallelGPU / CPU / RAMRuntime
1Ling-3.0-flash127.5BinclusionAI PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation)
253,67 tok/s TG
Prefill 1.397 · TTFT 48.511 ms
10×NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAMllama.cppgodclawQ4_K_M
2Ling-3.0-flash127.5BinclusionAI PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation)
250,66 tok/s TG
Prefill 1.396 · TTFT 48.986 ms
10×NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAMllama.cppgodclawQ4_K_M
3Ling-3.0-flash127.5BinclusionAI PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation)
247,76 tok/s TG
Prefill 1.399 · TTFT 49.349 ms
10×NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAMllama.cppgodclawQ4_K_M
4Ling-3.0-flash127.5BinclusionAI PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation)
142,76 tok/s TG
Prefill 1.244 · TTFT 17.133 ms
5×NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAMllama.cppgodclawQ4_K_M
5Ling-3.0-flash127.5BinclusionAI PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation)
140,35 tok/s TG
Prefill 1.237 · TTFT 17.315 ms
5×NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAMllama.cppgodclawQ4_K_M
6Ling-3.0-flash127.5BinclusionAI PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation)
139,82 tok/s TG
Prefill 1.244 · TTFT 17.279 ms
5×NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAMllama.cppgodclawQ4_K_M
7Ling-3.0-flash127.5BinclusionAI PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation)
108,98 tok/s TG
Prefill 1.446 · TTFT 66.475 ms
10×NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAMllama.cppopenclaw_cliQ4_K_M
8Ling-3.0-flash127.5BinclusionAI PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation)
90,05 tok/s TG
Prefill 1.600 · TTFT 43.239 ms
10×NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAMllama.cppopenclaw_cliQ4_K_M
9Ling-3.0-flash127.5BinclusionAI PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation)
49,10 tok/s TG
Prefill 1.157 · TTFT 10.523 ms
5×NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAMllama.cppopenclaw_cliQ4_K_M
10Ling-3.0-flash127.5BinclusionAI PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation)
48,48 tok/s TG
Prefill 1.201 · TTFT 2.031 ms
1×NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAMllama.cppgodclawQ4_K_M
11Ling-3.0-flash127.5BinclusionAI PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation)
48,44 tok/s TG
Prefill 1.189 · TTFT 2.051 ms
1×NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAMllama.cppgodclawQ4_K_M
12Ling-3.0-flash127.5BinclusionAI PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation)
47,20 tok/s TG
Prefill 1.176 · TTFT 2.071 ms
1×NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAMllama.cppgodclawQ4_K_M
13Ling-3.0-flash127.5BinclusionAI PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation)
46,50 tok/s TG
Prefill 1.156 · TTFT 10.550 ms
5×NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAMllama.cppopenclaw_cliQ4_K_M
14Ling-3.0-flash127.5BinclusionAI PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation)
33,12 tok/s TG
Prefill 1.171 · TTFT 2.084 ms
1×NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAMllama.cppopenclaw_cliQ4_K_M
15Ling-3.0-flash127.5BinclusionAI PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation)
28,27 tok/s TG
Prefill 1.151 · TTFT 2.118 ms
1×NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAMllama.cppopenclaw_cliQ4_K_M