MiniMax
MiniMax-M2.5
Harnessbenchmark · gemessen am 13.07.2026 19:14
Benchmark-ID
run-20260722-161611-a58abeTool Usage Standard 1.0MoE230BRuntime: godclawQuantisierung: BF16
Punkte2.033,00von 2.980,00
Punktequote68,22%
Aufgaben bestanden16von 16
Gesamtdauer373,00s
Einordnung im Feld
12von 30 Systemen
Harnessbenchmark · Leitmetrik: Punktequote (%)
Dieser Lauf ist besser als 62 % aller vergleichbaren Systeme.
Punktequote
68 %
+25 % vs Ø 54,4
Aufgaben bestanden
16
-14 % vs Ø 18,6
Gesamtdauer
373,0 s
-84 % vs Ø 2.395,9
Verteilung im Feld10 – 91 %
Wie schlägt sich dieser Benchmark?
Gemma-4-26B-A4B-itNVIDIA RTX PRO 6000 Blackwell Max-Q Workstation Edition · run-20260722-161611-05d866
91 %
Devstral-Small-2-24B-Instruct-2512AMD GPU · run-20260722-161611-5f2f86
87 %
Gemma-4-26B-A4B-itAMD GPU · run-20260722-161611-12a767
82 %
MiniMax-M2.5 gleiches Modell3× NVIDIA RTX PRO 6000 Blackwell Max-Q Workstation Edition · run-20260722-161611-f6cfe1
81 %
Gemma-4-26B-A4B-itAMD GPU · run-20260722-161611-9b7325
80 %
MiniMax-M2.5 gleiches Modell3× NVIDIA RTX PRO 6000 Blackwell Max-Q Workstation Edition · run-20260722-161611-54019f
79 %
Gemma-4-26B-A4B-itAMD GPU · run-20260722-161611-0064a9
76 %
Devstral-Small-2-24B-Instruct-2512AMD GPU · run-20260722-161611-798dcc
76 %
Gemma-4-26B-A4B-itAMD GPU · run-20260722-161611-78ff78
74 %
MiniMax-M2.5-BF16-INT4-AWQNVIDIA GB10 · run-20260722-165444-51f2b3
71 %
Devstral-Small-2-24B-Instruct-2512AMD GPU · run-20260722-161611-23baf9
69 %
MiniMax-M2.5 dieser Lauf3× NVIDIA RTX PRO 6000 Blackwell Max-Q Workstation Edition · run-20260722-161611-a58abe
68 %
MiniMax-M2.5 gleiches Modell3× NVIDIA RTX PRO 6000 Blackwell Max-Q Workstation Edition · run-20260722-161611-2a2c91
65 %
MiniMax-M2.5 gleiches Modell3× NVIDIA RTX PRO 6000 Blackwell Max-Q Workstation Edition · run-20260722-161610-99f36d
61 %
Hardware
GPU: 3x NVIDIA RTX PRO 6000 Blackwell Max-Q Workstation Edition · 96 GB VRAM
CPU: 34x AMD Ryzen Threadripper PRO 9965WX 24-Cores
RAM: 125 GB
Setup
Runtime: godclaw
Quantisierung: BF16
Modell: MiniMax-M2.5
Aufgaben (16)
| Aufgabe | Status | Punkte | Dauer |
|---|---|---|---|
| Antwortzeit Test | bestanden | 5 / 50 | 17,00 s |
| Format Test | bestanden | 44 / 80 | 15,00 s |
| Dateisystem Setup | bestanden | 94 / 120 | 11,00 s |
| Daten Generierung | bestanden | 94 / 150 | 25,00 s |
| Parsing + Transformation | bestanden | 140 / 200 | 30,00 s |
| Fehlerbehandlung JSON | bestanden | 101 / 150 | 22,00 s |
| Python Tool Usage | bestanden | 167 / 220 | 24,00 s |
| PHP Tool Usage | bestanden | 187 / 220 | 15,00 s |
| Export + Reimport | bestanden | 186 / 240 | 30,00 s |
| Archivierung | bestanden | 121 / 180 | 22,00 s |
| Hash Berechnung | bestanden | 114 / 200 | 36,00 s |
| Textsuche | bestanden | 59 / 180 | 45,00 s |
| Idempotenz Test | bestanden | 174 / 220 | 21,00 s |
| Rechte Problem | bestanden | 189 / 220 | 14,00 s |
| Final JSON | bestanden | 190 / 250 | 24,00 s |
| Finale Ausgabe | bestanden | 168 / 300 | 22,00 s |
Konfiguration
# LLM-Benchmark Konfiguration
# Modell : MiniMax-M2.5
# Engine : vLLM
# Run-ID : run-20260722-161611-a58abe
# GPU : 3x NVIDIA RTX PRO 6000 Blackwell Max-Q Workstation Edition
# CPU : 34x AMD Ryzen Threadripper PRO 9965WX 24-Cores
# RAM : 125 GB
bench@llm-benchmark:~$ /usr/bin/python3 /usr/local/bin/vllm serve \
--model mratsim/MiniMax-M2.5-BF16-INT4-AWQ \
--served-model-name MiniMax-M2.5 \
--tensor-parallel-size 1 \
--pipeline-parallel-size 3 \
--max-model-len 164000 \
--gpu-memory-utilization 0.90 \
--load-format safetensors \
--trust-remote-code \
--enforce-eager \
--disable-custom-all-reduce \
--enable-auto-tool-choice \
--tool-call-parser minimax_m2 \
--reasoning-parser minimax_m2_append_think
| Engine | vllm |
| Modellalias | MiniMax-M2.5 |
| Kontextlaenge | 164000 |
| Modellpfad | mratsim/MiniMax-M2.5-BF16-INT4-AWQ |
| Alias | MiniMax-M2.5 |
| Tensor-Parallel | 1 |
| Pipeline-Parallel | 3 |
| Kontext | 164000 |
| GPU-Speicher | 0.90 |
| Load-Format | safetensors |
| Trust-Remote-Code | aktiv |
| Enforce-Eager | aktiv |
| Custom-AllReduce aus | aktiv |
| Auto-Tool-Choice | aktiv |
| Tool-Parser | minimax_m2 |
| Reasoning-Parser | minimax_m2_append_think |
