Powered bymario-alka.degodcore.detricoma.denoob2claw.de
Offene Daten · reproduzierbare Tests

LLM-Leistung
messbar gemacht.

Performance- und Harnessbenchmarks fuer Modelle, Hardware und Runtimes. Transparent, filterbar und direkt vergleichbar.

2 Testarten100% transparentAPI ready
root@benchmark-node:/opt/llm#DEMO READY
root@llm-benchmark:~$ benchmark run --model qwen3-32b --type full

SYSTEM vLLM endpoint bereit auf :8000

MODEL Qwen3-32B / FP8 / 32k Kontext

DEMO Interaktive Vorschau eines LLM-Laufs

OPENAI CHAT COMPLETION ยท STREAM

user> Warte auf Benchmarkstart ...

assistant>

TTFT--MILLISEKUNDEN
GENERATION--TOKEN / SEK.
HARNESS--PUNKTE / 100
01

Echte Performance

TTFT, Prefill- und Generation-Token/s statt theoretischer Spitzenwerte.

02

Harness-Qualitaet

Punkte und Erfolgsquoten aus vollstaendigen Agent- und Chatablaeufen.

03

Volle Transparenz

Modell, Quantisierung, Runtime und Hardware bleiben an jedem Lauf sichtbar.

Aktuelle Messungen

Leaderboard Snapshot

Alle Ergebnisse →
#Modell / HerstellerTypMesswerteGPU / CPU / RAMRuntimeDatum
1Gemma-4-26B-A4B-itGoogleHarnessbenchmark90,64 %2.701,00 / 2.980,00 Punkte
16 / 16 Aufgaben · 118,00 s
NVIDIA RTX PRO 6000 Blac...32x AMD Ryzen 9 9950X 16-Core Processor · 1 GB RAMcli22.07.2026
2Devstral-Small-2-24B-Instruct-2512Mistral AIHarnessbenchmark87,15 %2.597,00 / 2.980,00 Punkte
16 / 16 Aufgaben · 165,00 s
AMD GPU32x AMD RYZEN AI MAX+ 395 w/ Radeon 8060S · 1 GB RAMgodclaw22.07.2026
3Gemma-4-26B-A4B-itGoogleHarnessbenchmark81,88 %2.440,00 / 2.980,00 Punkte
16 / 16 Aufgaben · 218,00 s
AMD GPU32x AMD RYZEN AI MAX+ 395 w/ Radeon 8060S · 5 GB RAMcli22.07.2026
4MiniMax-M2.5MiniMaxHarnessbenchmark81,44 %2.427,00 / 2.980,00 Punkte
16 / 16 Aufgaben · 228,00 s
3x NVIDIA RTX PRO 6000 Blac...34x AMD Ryzen Threadripper PRO 9965WX 24-Cores · 1 GB RAMgodclaw22.07.2026
5Gemma-4-26B-A4B-itGoogleHarnessbenchmark79,97 %2.383,00 / 2.980,00 Punkte
16 / 16 Aufgaben · 245,00 s
AMD GPU32x AMD RYZEN AI MAX+ 395 w/ Radeon 8060S · 5 GB RAMcli22.07.2026