Created bymario-alka.dePowered bygodcore.denoob2claw.detricoma.de
🎮
Grafikkarte

Keine GPU (CPU-only)

Other
4Benchmarks
4Modelle
4Performance
0Harness
Beste Generation
4,9 tok/s
NVIDIA-Nemotron-3-Nano-4B
∅ Generation
3,1 tok/s
Schnitt aus 4 Läufen
Bester Prefill
81 tok/s
Prompt-Verarbeitung
Bester TTFT
569 ms
Time to First Token
Beste Harness-Quote
%
noch kein Harness
🏆
NVIDIA-Nemotron-3-Nano-4B läuft am schnellsten auf dieser GPU · 4,9 tok/s
Bester Prefill: 81 tok/s · 4 Modelle getestet

Top-Modelle nach Token-Generierung

Bester gemessener Generierungs-Durchsatz je Modell auf Keine GPU (CPU-only) (tok/s).

MiniMax-M2.5
0,8 tok/s
Performanceprofil

Durchsatz auf Keine GPU (CPU-only)

Jede Blase steht für ein Modell, eine Engine bzw. eine CPU – Position: Prompt-Verarbeitung (X) × Ausgabe (Y), Blasengröße: Anzahl Messläufe.

MODnach Modell

6,34,73,11,60,06366696Prefill (tok/s)Generation (tok/s)NVIDIA-Nemotron-3-Nano-4B - 4,9 tok/s Generation, 41 tok/s Prefill, TTFT 62.079 ms (1 Lauf)NVIDIA-Nemotron-3-Nan...Qwen3.6-35B-A3B - 4,3 tok/s Generation, 62 tok/s Prefill, TTFT 31.435 ms (1 Lauf)Qwen3.6-35B-A3BQwen2.5-72B-Instruct-Q4_K_M.gguf - 2,3 tok/s Generation, 81 tok/s Prefill, TTFT 569 ms (1 Lauf)Qwen2.5-72B-Instruct-...MiniMax-M2.5 - 0,8 tok/s Generation, 22 tok/s Prefill, TTFT 98.716 ms (1 Lauf)MiniMax-M2.5
NVIDIA-Nemotron-3-Nano-4B 4,9 tok/sQwen3.6-35B-A3B 4,3 tok/sQwen2.5-72B-Instruct-Q4_K_M.gguf 2,3 tok/sMiniMax-M2.5 0,8 tok/s

ENGnach Engine

6,04,83,62,41,330517293Prefill (tok/s)Generation (tok/s)llama.cpp - 4,9 tok/s Generation, 41 tok/s Prefill, TTFT 64.077 ms (3 Laufe)llama.cppunbekannt - 2,3 tok/s Generation, 81 tok/s Prefill, TTFT 569 ms (1 Lauf)unbekannt
llama.cpp 4,9 tok/sunbekannt 2,3 tok/s

CPUnach Prozessor

5,45,24,94,74,448505254Prefill (tok/s)Generation (tok/s)Intel(R) Xeon(R) CPU E5-4620 v2 @ 2.60GHz - 4,9 tok/s Generation, 51 tok/s Prefill, TTFT 48.200 ms (4 Laufe)Intel(R) Xeon(R) CPU ...
Intel(R) Xeon(R) CPU E5-4620 v2 @ 2.60GHz 4,9 tok/s
Alle Messungen

4 Benchmark-Läufe

Jeder veroeffentlichte Lauf auf Keine GPU (CPU-only) – Performance und Harness.

Im Leaderboard →
#Modell / HerstellerTypMesswerteGPU / CPU / RAMRuntimeDatum
1NVIDIA-Nemotron-3-Nano-4BNVIDIATimebench 3 - Kombi (Prefill + Generation)Performancebenchmark
4,94 tok/s
Prefill 41 · TTFT 62.079 ms
Keine GPU (CPU-only)51x Intel(R) Xeon(R) CPU E5-4620 v2 @ 2.60GHz · 504 GB RAMllama.cppgodclaw Q4_K_M22.07.2026
2Qwen3.6-35B-A3BQwen (Alibaba)Timebench 3 - Kombi (Prefill + Generation)Performancebenchmark
4,29 tok/s
Prefill 62 · TTFT 31.435 ms
Keine GPU (CPU-only)51x Intel(R) Xeon(R) CPU E5-4620 v2 @ 2.60GHz · 504 GB RAMllama.cppgodclaw Q4_K_M22.07.2026
3Qwen2.5-72B-Instruct-Q4_K_M.ggufQwen (Alibaba)Performancetest Small 1.0Performancebenchmark
2,28 tok/s
Prefill 81 · TTFT 569 ms
Keine GPU (CPU-only)51x Intel(R) Xeon(R) CPU E5-4620 v2 @ 2.60GHz · 504 GB RAMgodclaw20.07.2026
4MiniMax-M2.5MiniMaxTimebench 3 - Kombi (Prefill + Generation)Performancebenchmark
0,84 tok/s
Prefill 22 · TTFT 98.716 ms
Keine GPU (CPU-only)51x Intel(R) Xeon(R) CPU E5-4620 v2 @ 2.60GHz · 504 GB RAMllama.cppgodclaw Q4_K_M22.07.2026

← Alle Hardware