🎮
Grafikkarte
Keine GPU (CPU-only)
Other
Beste Generation
4,9 tok/s
NVIDIA-Nemotron-3-Nano-4B
∅ Generation
3,1 tok/s
Schnitt aus 4 Läufen
Bester Prefill
81 tok/s
Prompt-Verarbeitung
Bester TTFT
569 ms
Time to First Token
Beste Harness-Quote
–%
noch kein Harness
🏆
NVIDIA-Nemotron-3-Nano-4B läuft am schnellsten auf dieser GPU · 4,9 tok/s
Bester Prefill: 81 tok/s · 4 Modelle getestet
Bester Prefill: 81 tok/s · 4 Modelle getestet
Top-Modelle nach Token-Generierung
Bester gemessener Generierungs-Durchsatz je Modell auf Keine GPU (CPU-only) (tok/s).
Performanceprofil
Durchsatz auf Keine GPU (CPU-only)
Jede Blase steht für ein Modell, eine Engine bzw. eine CPU – Position: Prompt-Verarbeitung (X) × Ausgabe (Y), Blasengröße: Anzahl Messläufe.
MODnach Modell
NVIDIA-Nemotron-3-Nano-4B 4,9 tok/sQwen3.6-35B-A3B 4,3 tok/sQwen2.5-72B-Instruct-Q4_K_M.gguf 2,3 tok/sMiniMax-M2.5 0,8 tok/s
ENGnach Engine
llama.cpp 4,9 tok/sunbekannt 2,3 tok/s
CPUnach Prozessor
Intel(R) Xeon(R) CPU E5-4620 v2 @ 2.60GHz 4,9 tok/s
Alle Messungen
Im Leaderboard →4 Benchmark-Läufe
Jeder veroeffentlichte Lauf auf Keine GPU (CPU-only) – Performance und Harness.
| # | Modell / Hersteller | Typ | Messwerte | GPU / CPU / RAM | Runtime | Datum | ||
|---|---|---|---|---|---|---|---|---|
| 1 | NVIDIA-Nemotron-3-Nano-4BNVIDIATimebench 3 - Kombi (Prefill + Generation) | Performancebenchmark | 4,94 tok/s Prefill 41 · TTFT 62.079 ms | Keine GPU (CPU-only)51x Intel(R) Xeon(R) CPU E5-4620 v2 @ 2.60GHz · 504 GB RAM | llama.cppgodclaw Q4_K_M | 22.07.2026 | Details → | |
| 2 | Qwen3.6-35B-A3BQwen (Alibaba)Timebench 3 - Kombi (Prefill + Generation) | Performancebenchmark | 4,29 tok/s Prefill 62 · TTFT 31.435 ms | Keine GPU (CPU-only)51x Intel(R) Xeon(R) CPU E5-4620 v2 @ 2.60GHz · 504 GB RAM | llama.cppgodclaw Q4_K_M | 22.07.2026 | Details → | |
| 3 | Qwen2.5-72B-Instruct-Q4_K_M.ggufQwen (Alibaba)Performancetest Small 1.0 | Performancebenchmark | 2,28 tok/s Prefill 81 · TTFT 569 ms | Keine GPU (CPU-only)51x Intel(R) Xeon(R) CPU E5-4620 v2 @ 2.60GHz · 504 GB RAM | godclaw | 20.07.2026 | Details → | |
| 4 | MiniMax-M2.5MiniMaxTimebench 3 - Kombi (Prefill + Generation) | Performancebenchmark | 0,84 tok/s Prefill 22 · TTFT 98.716 ms | Keine GPU (CPU-only)51x Intel(R) Xeon(R) CPU E5-4620 v2 @ 2.60GHz · 504 GB RAM | llama.cppgodclaw Q4_K_M | 22.07.2026 | Details → |
