Created bymario-alka.dePowered bygodcore.denoob2claw.detricoma.de
Mistral AI

Devstral-Small-2-24B-Instruct-2512

Harnessbenchmark · gemessen am 16.07.2026 07:54

Benchmark-IDrun-20260722-161611-5f2f86
Tool Usage Standard 1.0Dense24BRuntime: godclawQuantisierung: Q8_0
Punkte2.597,00von 2.980,00
Punktequote87,15%
Aufgaben bestanden16von 16
Gesamtdauer165,00s
Einordnung im Feld
2von 30 Systemen

Harnessbenchmark · Leitmetrik: Punktequote (%)

Dieser Lauf ist besser als 97 % aller vergleichbaren Systeme.
Punktequote 87 %
+60 % vs Ø 54,4
Aufgaben bestanden 16
-14 % vs Ø 18,6
Gesamtdauer 165,0 s
-93 % vs Ø 2.395,9
Verteilung im Feld10 – 91 %
Ø 54 Median Dieser Lauf

Wie schlägt sich dieser Benchmark?

Hardware

GPU: AMD GPU · 0 GB VRAM
CPU: 32x AMD RYZEN AI MAX+ 395 w/ Radeon 8060S
RAM: 31 GB

Setup

Runtime: godclaw
Quantisierung: Q8_0
Modell: Devstral-Small-2-24B-Instruct-2512

Aufgaben (16)

AufgabeStatusPunkteDauer
Antwortzeit Testbestanden38 / 504,00 s
Format Testbestanden73 / 803,00 s
Dateisystem Setupbestanden113 / 1203,00 s
Daten Generierungbestanden98 / 15023,00 s
Parsing + Transformationbestanden146 / 20027,00 s
Fehlerbehandlung JSONbestanden107 / 15019,00 s
Python Tool Usagebestanden216 / 2202,00 s
PHP Tool Usagebestanden143 / 22035,00 s
Export + Reimportbestanden233 / 2404,00 s
Archivierungbestanden172 / 1803,00 s
Hash Berechnungbestanden193 / 2003,00 s
Textsuchebestanden172 / 1803,00 s
Idempotenz Testbestanden211 / 2204,00 s
Rechte Problembestanden183 / 22017,00 s
Final JSONbestanden223 / 25011,00 s
Finale Ausgabebestanden276 / 3004,00 s

Konfiguration

benchmark-konfiguration — run-20260722-161611-5f2f86
# LLM-Benchmark Konfiguration # Modell : Devstral-Small-2-24B-Instruct-2512 # Engine : llama.cpp # Run-ID : run-20260722-161611-5f2f86 # GPU : AMD GPU # CPU : 32x AMD RYZEN AI MAX+ 395 w/ Radeon 8060S # RAM : 31 GB bench@llm-benchmark:~$ /home/godcore/llama.cpp/build-rocm/bin/llama-server \ --model /home/godcore/models/devstral-small-2-24b-q8_0-gguf/Devstral-Small-2-24B-Instruct-2512-Q8_0.gguf \ --alias mistralai/Devstral-Small-2-24B-Instruct-2512 \ --host 0.0.0.0 \ --port 8000 \ --ctx-size 131072 \ --parallel 1 \ --temp 0.2 \ --repeat-penalty 1.05 \ --repeat-last-n 256 \ --gpu-layers 99 \ --flash-attn on \ --jinja \ --chat-template-file /home/godcore/models/devstral-small-2-24b-q8_0-gguf/chat_template.jinja \ --threads 8 \ --threads-batch 16
Enginellamacpp
Modellaliasmistralai/Devstral-Small-2-24B-Instruct-2512
Kontextlaenge131072
Modellpfad/home/godcore/models/devstral-small-2-24b-q8_0-gguf/Devstral-Small-2-24B-Instruct-2512-Q8_0.gguf
Parallel1
Temperatur0.2
Repeat-Penalty1.05
Repeat-Last-N256
GPU-Layer99
Flash Attentionon
Jinjaaktiv
Chat-Template/home/godcore/models/devstral-small-2-24b-q8_0-gguf/chat_template.jinja
Threads8
Batch-Threads16

Alle Benchmarks dieses Modells Zum Leaderboard