🎮
Grafikkarte
NVIDIA GB10 (DGX Spark)
NVIDIA128 GB VRAM
Beste Generation
903,3 tok/s
gemma-4-E2B-it
∅ Generation
148,9 tok/s
Schnitt aus 82 Läufen
Bester Prefill
7.470 tok/s
Prompt-Verarbeitung
Bester TTFT
105 ms
Time to First Token
Beste Harness-Quote
71%
5 Harness-Läufe
🏆
gemma-4-E2B-it läuft am schnellsten auf dieser GPU · 903,3 tok/s
Bester Prefill: 7.470 tok/s · 18 Modelle getestet
Bester Prefill: 7.470 tok/s · 18 Modelle getestet
Top-Modelle
Bester gemessener Durchsatz je Modell auf NVIDIA GB10 (DGX Spark) – umschaltbar nach Generation, Prefill oder Kombiwert.
Performanceprofil
Durchsatz auf NVIDIA GB10 (DGX Spark)
Jede Blase steht für ein Modell, eine Engine bzw. eine CPU – Position: Prompt-Verarbeitung (X) × Ausgabe (Y), Blasengröße: Anzahl Messläufe.
MODnach Modell
gemma-4-E2B-it 903,3 tok/sgemma-4-E4B-it 488,2 tok/sNemotron-3-Nano-4B 367,8 tok/sLing-3.0-flash 253,7 tok/sgpt-oss-20b 202,1 tok/sQwen3-Coder-30B-A3B-Instruct 182,9 tok/sMiniMax-M2.7 174,2 tok/sQwen3-30B-A3B-Instruct-2507 169,9 tok/sQwen3.6-35B-A3B 167,1 tok/sNemotron-Cascade-2-30B-A3B 148,8 tok/sMiniMax-M2.5 105,6 tok/sCodestral-22B-v0.1 80,0 tok/sNemotron-3-Nano-30B-A3B 58,3 tok/sglm-4.7-flash 48,9 tok/sGemma-4-26B-A4B 47,1 tok/sQwen3.5-35B-A3B 46,9 tok/sQwen3-Coder-Next 38,5 tok/s
Durchsatz & Latenz
Im Leaderboard →Performancebenchmark
76 veroeffentlichte Performance-Läufe auf NVIDIA GB10 (DGX Spark).
| # | Modell / Hersteller | Messwerte | Parallel | GPU / CPU / RAM | Runtime | ||
|---|---|---|---|---|---|---|---|
| 1 | gemma-4-E2B-it5BGoogle PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 903,30 tok/s TG Prefill 6.960 · TTFT 11.382 ms | 10× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 2 | gemma-4-E2B-it5BGoogle PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 860,88 tok/s TG Prefill 6.641 · TTFT 11.413 ms | 10× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 3 | gemma-4-E4B-it8BGoogle PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 488,18 tok/s TG Prefill 4.229 · TTFT 20.915 ms | 10× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 4 | gemma-4-E4B-it8BGoogle PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 484,77 tok/s TG Prefill 4.124 · TTFT 21.088 ms | 10× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 5 | gemma-4-E2B-it5BGoogle PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 478,55 tok/s TG Prefill 6.243 · TTFT 3.601 ms | 5× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 6 | gemma-4-E2B-it5BGoogle PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 461,54 tok/s TG Prefill 5.838 · TTFT 3.795 ms | 5× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 7 | gemma-4-E4B-it8BGoogle PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 455,06 tok/s TG Prefill 3.954 · TTFT 21.269 ms | 10× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 8 | Nemotron-3-Nano-4B4BNVIDIA PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 367,75 tok/s TG Prefill 3.397 · TTFT 29.121 ms | 10× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 9 | Nemotron-3-Nano-4B4BNVIDIA PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 354,29 tok/s TG Prefill 3.544 · TTFT 30.045 ms | 10× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 10 | Ling-3.0-flash127.5BinclusionAI PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 253,67 tok/s TG Prefill 1.397 · TTFT 48.511 ms | 10× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 11 | gemma-4-E4B-it8BGoogle PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 251,39 tok/s TG Prefill 3.708 · TTFT 6.599 ms | 5× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 12 | Ling-3.0-flash127.5BinclusionAI PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 250,66 tok/s TG Prefill 1.396 · TTFT 48.986 ms | 10× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 13 | Ling-3.0-flash127.5BinclusionAI PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 247,76 tok/s TG Prefill 1.399 · TTFT 49.349 ms | 10× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 14 | gemma-4-E4B-it8BGoogle PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 246,68 tok/s TG Prefill 3.165 · TTFT 7.126 ms | 5× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 15 | gemma-4-E4B-it8BGoogle PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 245,62 tok/s TG Prefill 3.740 · TTFT 6.690 ms | 5× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 16 | Nemotron-3-Nano-4B4BNVIDIA PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 210,25 tok/s TG Prefill 3.483 · TTFT 8.798 ms | 5× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 17 | Nemotron-3-Nano-4B4BNVIDIA PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 202,30 tok/s TG Prefill 3.149 · TTFT 9.380 ms | 5× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 18 | gpt-oss-20b20BOpenAI PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 202,12 tok/s TG Prefill 4.412 · TTFT 4.498 ms | 10× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | llama.cppopenclaw_cliMXFP4 | Details → | |
| 19 | Qwen3-Coder-30B-A3B-Instruct30BQwen (Alibaba) PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 182,87 tok/s TG Prefill 7.295 · TTFT 5.014 ms | 10× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | llama.cppopenclaw_cliQ4_K_M | Details → | |
| 20 | MiniMax-M2.7230BMiniMax PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 174,20 tok/s TG Prefill 5.042 · TTFT 47.620 ms | 10× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | vLLMgodclawAWQ | Details → | |
| 21 | Qwen3-30B-A3B-Instruct-250730BQwen (Alibaba) PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 169,89 tok/s TG Prefill 7.470 · TTFT 5.007 ms | 10× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | llama.cppopenclaw_cliQ4_K_M | Details → | |
| 22 | Qwen3.6-35B-A3B35BQwen (Alibaba) PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 167,11 tok/s TG Prefill 2.814 · TTFT 6.937 ms | 10× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | llama.cppopenclaw_cliQ4_K_M | Details → | |
| 23 | gpt-oss-20b20BOpenAI PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 148,88 tok/s TG Prefill 4.312 · TTFT 2.296 ms | 5× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | llama.cppopenclaw_cliMXFP4 | Details → | |
| 24 | Nemotron-Cascade-2-30B-A3B30BNVIDIA PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 148,79 tok/s TG Prefill 3.362 · TTFT 6.588 ms | 10× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | llama.cppopenclaw_cliQ4_K_M | Details → | |
| 25 | Qwen3-Coder-30B-A3B-Instruct30BQwen (Alibaba) PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 146,91 tok/s TG Prefill 4.736 · TTFT 2.900 ms | 5× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | llama.cppopenclaw_cliQ4_K_M | Details → | |
| 26 | Ling-3.0-flash127.5BinclusionAI PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 142,76 tok/s TG Prefill 1.244 · TTFT 17.133 ms | 5× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 27 | Ling-3.0-flash127.5BinclusionAI PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 140,35 tok/s TG Prefill 1.237 · TTFT 17.315 ms | 5× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 28 | Ling-3.0-flash127.5BinclusionAI PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 139,82 tok/s TG Prefill 1.244 · TTFT 17.279 ms | 5× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 29 | Qwen3-30B-A3B-Instruct-250730BQwen (Alibaba) PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 139,24 tok/s TG Prefill 5.091 · TTFT 2.946 ms | 5× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | llama.cppopenclaw_cliQ4_K_M | Details → | |
| 30 | Qwen3.6-35B-A3B35BQwen (Alibaba) PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 135,61 tok/s TG Prefill 2.590 · TTFT 3.731 ms | 5× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | llama.cppopenclaw_cliQ4_K_M | Details → | |
| 31 | Nemotron-Cascade-2-30B-A3B30BNVIDIA PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 123,54 tok/s TG Prefill 2.897 · TTFT 3.743 ms | 5× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | llama.cppopenclaw_cliQ4_K_M | Details → | |
| 32 | Ling-3.0-flash127.5BinclusionAI PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 108,98 tok/s TG Prefill 1.446 · TTFT 66.475 ms | 10× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | llama.cppopenclaw_cliQ4_K_M | Details → | |
| 33 | MiniMax-M2.7230BMiniMax PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 108,63 tok/s TG Prefill 4.568 · TTFT 13.673 ms | 5× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | vLLMgodclawAWQ | Details → | |
| 34 | MiniMax-M2.7230BMiniMax PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 106,12 tok/s TG Prefill 5.634 · TTFT 12.854 ms | 5× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | vLLMgodclawAWQ | Details → | |
| 35 | MiniMax-M2.5230BMiniMax PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 105,57 tok/s TG Prefill 6.997 · TTFT 5.319 ms | 10× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | vLLMgodclawAWQ | Details → | |
| 36 | MiniMax-M2.5230BMiniMax PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 103,49 tok/s TG Prefill 7.016 · TTFT 5.294 ms | 10× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | vLLMgodclawAWQ | Details → | |
| 37 | MiniMax-M2.7230BMiniMax PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 103,25 tok/s TG Prefill 6.620 · TTFT 5.066 ms | 10× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | vLLMgodclawAWQ | Details → | |
| 38 | Nemotron-Cascade-2-30B-A3B30BNVIDIA PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 101,36 tok/s TG Prefill 3.237 · TTFT 6.850 ms | 10× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | llama.cppopenclaw_cliQ8_0 | Details → | |
| 39 | Qwen3.6-35B-A3B35BQwen (Alibaba) PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 101,18 tok/s TG Prefill 6.144 · TTFT 314 ms | 1× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | vLLMgodclawNVFP4 | Details → | |
| 40 | Qwen3.6-35B-A3B35BQwen (Alibaba) PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 100,59 tok/s TG Prefill 6.798 · TTFT 285 ms | 1× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | vLLMgodclawNVFP4 | Details → | |
| 41 | Qwen3.6-35B-A3B35BQwen (Alibaba) PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 92,96 tok/s TG Prefill 4.802 · TTFT 404 ms | 1× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | vLLMgodclawNVFP4 | Details → | |
| 42 | Ling-3.0-flash127.5BinclusionAI PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 90,05 tok/s TG Prefill 1.600 · TTFT 43.239 ms | 10× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | llama.cppopenclaw_cliQ4_K_M | Details → | |
| 43 | Qwen3-Coder-30B-A3B-Instruct30BQwen (Alibaba) PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 86,23 tok/s TG Prefill 2.963 · TTFT 824 ms | 1× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | llama.cppopenclaw_cliQ4_K_M | Details → | |
| 44 | Nemotron-Cascade-2-30B-A3B30BNVIDIA PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 84,61 tok/s TG Prefill 2.849 · TTFT 3.806 ms | 5× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | llama.cppopenclaw_cliQ8_0 | Details → | |
| 45 | Qwen3-30B-A3B-Instruct-250730BQwen (Alibaba) PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 84,18 tok/s TG Prefill 2.987 · TTFT 816 ms | 1× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | llama.cppopenclaw_cliQ4_K_M | Details → | |
| 46 | gpt-oss-20b20BOpenAI PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 82,16 tok/s TG Prefill 3.589 · TTFT 550 ms | 1× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | llama.cppopenclaw_cliMXFP4 | Details → | |
| 47 | Codestral-22B-v0.122BMistral AI Performancebenchmark | 80,00 tok/s TG Prefill 1.200 · TTFT 150 ms | 8× | NVIDIA GB10 (DGX Spark)AMD Ryzen 9 9950X 16-Core Processor · 128 GB RAM | vLLMvllm | Details → | |
| 48 | MiniMax-M2.5230BMiniMax PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 77,74 tok/s TG Prefill 5.460 · TTFT 2.641 ms | 5× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | vLLMgodclawAWQ | Details → | |
| 49 | Nemotron-Cascade-2-30B-A3B30BNVIDIA PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 76,95 tok/s TG Prefill 2.356 · TTFT 929 ms | 1× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | llama.cppopenclaw_cliQ4_K_M | Details → | |
| 50 | Nemotron-3-Nano-4B4BNVIDIA PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 76,87 tok/s TG Prefill 2.223 · TTFT 1.006 ms | 1× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 51 | Qwen3.6-35B-A3B35BQwen (Alibaba) PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 74,19 tok/s TG Prefill 4.923 · TTFT 393 ms | 1× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | vLLMgodclawNVFP4 | Details → | |
| 52 | MiniMax-M2.5230BMiniMax PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 73,44 tok/s TG Prefill 5.550 · TTFT 2.628 ms | 5× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | vLLMgodclawAWQ | Details → | |
| 53 | Nemotron-3-Nano-4B4BNVIDIA PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 72,70 tok/s TG Prefill 1.798 · TTFT 1.470 ms | 1× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 54 | Qwen3.6-35B-A3B35BQwen (Alibaba) PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 68,40 tok/s TG Prefill 2.292 · TTFT 842 ms | 1× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | llama.cppopenclaw_cliQ4_K_M | Details → | |
| 55 | MiniMax-M2.7230BMiniMax PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 66,75 tok/s TG Prefill 6.946 · TTFT 4.901 ms | 10× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | vLLMgodclawAWQ | Details → | |
| 56 | MiniMax-M2.7230BMiniMax PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 64,45 tok/s TG Prefill 7.167 · TTFT 4.743 ms | 10× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | vLLMgodclawAWQ | Details → | |
| 57 | gemma-4-E4B-it8BGoogle PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 63,50 tok/s TG Prefill 2.576 · TTFT 769 ms | 1× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 58 | Nemotron-Cascade-2-30B-A3B30BNVIDIA PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 62,04 tok/s TG Prefill 2.341 · TTFT 935 ms | 1× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | llama.cppopenclaw_cliQ8_0 | Details → | |
| 59 | gemma-4-E4B-it8BGoogle PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 60,50 tok/s TG Prefill 1.862 · TTFT 1.599 ms | 1× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 60 | Nemotron-3-Nano-30B-A3B30BNVIDIA PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 58,25 tok/s TG Prefill 5.466 · TTFT 395 ms | 1× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | vLLMgodclawNVFP4 | Details → | |
| 61 | MiniMax-M2.7230BMiniMax PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 52,46 tok/s TG Prefill 5.268 · TTFT 2.720 ms | 5× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | vLLMgodclawAWQ | Details → | |
| 62 | MiniMax-M2.7230BMiniMax PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 51,61 tok/s TG Prefill 5.448 · TTFT 2.676 ms | 5× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | vLLMgodclawAWQ | Details → | |
| 63 | Ling-3.0-flash127.5BinclusionAI PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 49,10 tok/s TG Prefill 1.157 · TTFT 10.523 ms | 5× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | llama.cppopenclaw_cliQ4_K_M | Details → | |
| 64 | glm-4.7-flashZ.ai (Zhipu) PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 48,92 tok/s TG Prefill 4.055 · TTFT 536 ms | 1× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | vLLMgodclawAWQ | Details → | |
| 65 | Ling-3.0-flash127.5BinclusionAI PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 48,48 tok/s TG Prefill 1.201 · TTFT 2.031 ms | 1× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 66 | Ling-3.0-flash127.5BinclusionAI PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 48,44 tok/s TG Prefill 1.189 · TTFT 2.051 ms | 1× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 67 | Ling-3.0-flash127.5BinclusionAI PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 47,20 tok/s TG Prefill 1.176 · TTFT 2.071 ms | 1× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 68 | Gemma-4-26B-A4B26BGoogle PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 47,06 tok/s TG Prefill 4.378 · TTFT 451 ms | 1× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | vLLMgodclawNVFP4 | Details → | |
| 69 | Qwen3.5-35B-A3B35BQwen (Alibaba) PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 46,91 tok/s TG Prefill 3.713 · TTFT 537 ms | 1× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | vLLMgodclawFP8 | Details → | |
| 70 | Qwen3.6-35B-A3B35BQwen (Alibaba) PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 46,79 tok/s TG Prefill 3.315 · TTFT 589 ms | 1× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | vLLMgodclawFP8 | Details → | |
| 71 | Ling-3.0-flash127.5BinclusionAI PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 46,50 tok/s TG Prefill 1.156 · TTFT 10.550 ms | 5× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | llama.cppopenclaw_cliQ4_K_M | Details → | |
| 72 | Qwen3-Coder-NextQwen (Alibaba) PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 38,54 tok/s TG Prefill 2.124 · TTFT 1.146 ms | 1× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | vLLMgodclawFP8 | Details → | |
| 73 | MiniMax-M2.7230BMiniMax PerformancebenchmarkPerformancetest Small 1.0 | 34,37 tok/s TG Prefill 503 · TTFT 105 ms | 1× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | vLLMgodclawAWQ | Details → | |
| 74 | Ling-3.0-flash127.5BinclusionAI PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 33,12 tok/s TG Prefill 1.171 · TTFT 2.084 ms | 1× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | llama.cppopenclaw_cliQ4_K_M | Details → | |
| 75 | MiniMax-M2.5230BMiniMax PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 32,23 tok/s TG Prefill 2.184 · TTFT 1.050 ms | 1× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | vLLMgodclawAWQ | Details → | |
| 76 | MiniMax-M2.5230BMiniMax PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 31,93 tok/s TG Prefill 2.096 · TTFT 1.093 ms | 1× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | vLLMgodclawAWQ | Details → |
Agent- & Chat-Bewertung
Im Leaderboard →Harnessbenchmark
4 veroeffentlichte Harness-Läufe auf NVIDIA GB10 (DGX Spark).
| # | Modell / Hersteller | Messwerte | GPU / CPU / RAM | Runtime | ||
|---|---|---|---|---|---|---|
| 1 | MiniMax-M2.5230BMiniMax HarnessbenchmarkTool Usage V 1.0 | 1.245 Pkt 70,7% · 15/15 Aufg. · 301,0 s | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | openclaw_cli | Details → | |
| 2 | MiniMax-M2.7230BMiniMax HarnessbenchmarkTool-Parcours Dossier 40 V1.0 | 3.641 Pkt 61,1% · 40/40 Aufg. · 8.209,0 s | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | vLLMgodclawAWQ | Details → | |
| 3 | MiniMax-M2.5230BMiniMax HarnessbenchmarkTool Usage Standard 1.0 | 1.762 Pkt 59,1% · 16/16 Aufg. · 526,0 s | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | openclaw_cli | Details → | |
| 4 | MiniMax-M2.5230BMiniMax HarnessbenchmarkTextgenerierung V 1.0 | 790 Pkt 52,0% · 15/15 Aufg. · 261,0 s | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | openclaw_cli | Details → |
Technische Daten
Technische Daten – NVIDIA GB10 (DGX Spark)
| Hersteller | NVIDIA |
|---|---|
| Architektur | Grace Blackwell |
| VRAM | 128 GB |
| Speicherbandbreite | 273 GB/s |
| TDP | 140 W |
| Release | 05/2025 |
| Beste Generation | 903,3 tok/s |
| Bester Prefill | 7.470 tok/s |
| Modelle | 18 |
| Messläufe (Performance) | 82 |

