Created bymario-alka.dePowered bygodcore.denoob2claw.detricoma.de
Beigesteuert vonMario AlkaQwen (Alibaba)

Qwen2.5-32B-Instruct-AWQ

Harnessbenchmark · gemessen am 04.04.2026 11:15

Benchmark-IDrun-20260722-161610-de118a
Tool Usage V 1.0Dense32BRuntime: openclaw_cli
Zur Einordnung: Diese Plattform nutzt Unified Memory – die "VRAM" ist gemeinsamer System-RAM (APU/Superchip); das Modell teilt sich den Speicher mit dem System.
Punkte235,00von 1.760,00
Punktequote13,35%
Aufgaben bestanden15von 15
Gesamtdauer1.783,00s
Einordnung im Feld
11von 13 Systemen

Harnessbenchmark · Leitmetrik: Punktequote (%)

Dieser Lauf ist besser als 17 % aller vergleichbaren Systeme.
Punktequote 13 %
-74 % vs Ø 50,4
Aufgaben bestanden 15
-27 % vs Ø 20,6
Gesamtdauer 1.783,0 s
-42 % vs Ø 3.076,5
Verteilung im Feld10 – 87 %
Ø 50 Median Dieser Lauf

Wie schlägt sich dieser Benchmark mit anderen Modellen?

Hardware

GPU: AMD Radeon 8060S Graphics
CPU: AMD RYZEN AI MAX+ 395 w/ Radeon 8060S
RAM: 31 GB
Mainboard: Bosgame AXB35-02 (BeyondMax Series)

Setup

Runtime: openclaw_cli
Quantisierung: -
Modell: Qwen2.5-32B-Instruct-AWQ

Aufgaben (15)

AufgabeStatusPunkteDauer
Antwortzeit Testbestanden5 / 5053,00 s
JSON Direkt Ausgabebestanden7 / 7060,00 s
Kurzinhalt Benchmarkbestanden6 / 6056,00 s
Textdatei anlegenbestanden10 / 100119,00 s
JSON Datei erzeugenbestanden12 / 12099,00 s
JSON Datei lesen und Feld ausgebenbestanden12 / 120148,00 s
Komplexeres JSON erzeugenbestanden14 / 140196,00 s
JSON auswerten Summebestanden15 / 15072,00 s
Python Code erzeugenbestanden13 / 130120,00 s
Python Code ausfuehrenbestanden24 / 15056,00 s
PHP Datei erzeugenbestanden13 / 130123,00 s
PHP Datei ausfuehrenbestanden65 / 15038,00 s
Markdown Inhalt generierenbestanden11 / 110316,00 s
Dateiinhalt pruefenbestanden10 / 10051,00 s
Mehrstufige Verarbeitungbestanden18 / 180276,00 s

Alle Benchmarks dieses Modells Zum Leaderboard

Anzeige
Modell-Vergleich

Qwen2.5-32B-Instruct-AWQ auf verschiedener Hardware

Alle veröffentlichten Performance-Läufe dieses Modells – jede Blase eine Variante: Position = Prefill (X) × Generation (Y), Blasengröße = Anzahl Läufe. Näher oben rechts = schneller. ★ Gold markiert = dieser Benchmark.

GPUnach Grafikkarte

6594943291650,001.8803.7615.641Prefill (tok/s)Generation (tok/s)NVIDIA RTX PRO 6000 Blackwell Workstation Edition - 510,3 tok/s Generation, 4.510 tok/s Prefill, TTFT 5.988 ms (6 Laufe)NVIDIA RTX PRO 6000 B...NVIDIA GeForce RTX 5090 - 473,9 tok/s Generation, 4.532 tok/s Prefill, TTFT 9.919 ms (3 Laufe)NVIDIA GeForce RTX 50...NVIDIA RTX PRO 6000 Blackwell Max-Q Workstation Edition - 412,6 tok/s Generation, 4.568 tok/s Prefill, TTFT 11.783 ms (9 Laufe)NVIDIA RTX PRO 6000 B...NVIDIA RTX A6000 - 362,6 tok/s Generation, 4.063 tok/s Prefill, TTFT 4.052 ms (9 Laufe)NVIDIA RTX A6000NVIDIA GeForce RTX 3090 Ti - 223,8 tok/s Generation, 2.049 tok/s Prefill, TTFT 20.233 ms (6 Laufe)NVIDIA GeForce RTX 30...AMD Radeon PRO W7900 Dual Slot - 89,6 tok/s Generation, 1.013 tok/s Prefill, TTFT 13.903 ms (3 Laufe)AMD Radeon PRO W7900 ...AMD Radeon PRO W7800 48GB - 69,9 tok/s Generation, 1.608 tok/s Prefill, TTFT 9.864 ms (3 Laufe)AMD Radeon PRO W7800 ...NVIDIA GeForce RTX 5070 Ti - 45,0 tok/s Generation, 619 tok/s Prefill, TTFT 95.102 ms (3 Laufe)NVIDIA GeForce RTX 50...AMD Radeon AI PRO R9700 - 22,3 tok/s Generation, 127 tok/s Prefill, TTFT 138.392 ms (10 Laufe)AMD Radeon AI PRO R97...
NVIDIA RTX PRO 6000 Blackwell Workstation Edition 510,3 tok/sNVIDIA GeForce RTX 5090 473,9 tok/sNVIDIA RTX PRO 6000 Blackwell Max-Q Workstation Edition 412,6 tok/sNVIDIA RTX A6000 362,6 tok/sNVIDIA GeForce RTX 3090 Ti 223,8 tok/sAMD Radeon PRO W7900 Dual Slot 89,6 tok/sAMD Radeon PRO W7800 48GB 69,9 tok/sNVIDIA GeForce RTX 5070 Ti 45,0 tok/sAMD Radeon AI PRO R9700 22,3 tok/s

CPUnach Prozessor

6464843231610,01781.9423.7065.470Prefill (tok/s)Generation (tok/s)AMD Ryzen 9 9950X 16-Core Processor - 510,3 tok/s Generation, 4.510 tok/s Prefill, TTFT 5.988 ms (6 Laufe)AMD Ryzen 9 9950X 16-...AMD Ryzen 7 5800X3D 8-Core Processor - 473,9 tok/s Generation, 4.532 tok/s Prefill, TTFT 9.919 ms (3 Laufe)AMD Ryzen 7 5800X3D 8...AMD Ryzen Threadripper PRO 9965WX 24-Cores - 412,6 tok/s Generation, 4.568 tok/s Prefill, TTFT 11.783 ms (9 Laufe)AMD Ryzen Threadrippe...AMD Ryzen Threadripper PRO 7955WX 16-Cores - 362,6 tok/s Generation, 1.991 tok/s Prefill, TTFT 74.758 ms (19 Laufe)AMD Ryzen Threadrippe...AMD Ryzen 9 8945HX with Radeon Graphics - 223,8 tok/s Generation, 2.049 tok/s Prefill, TTFT 20.233 ms (6 Laufe)AMD Ryzen 9 8945HX wi...AMD Ryzen Threadripper PRO 5975WX 32-Cores - 89,6 tok/s Generation, 1.080 tok/s Prefill, TTFT 39.623 ms (9 Laufe)AMD Ryzen Threadrippe...
AMD Ryzen 9 9950X 16-Core Processor 510,3 tok/sAMD Ryzen 7 5800X3D 8-Core Processor 473,9 tok/sAMD Ryzen Threadripper PRO 9965WX 24-Cores 412,6 tok/sAMD Ryzen Threadripper PRO 7955WX 16-Cores 362,6 tok/sAMD Ryzen 9 8945HX with Radeon Graphics 223,8 tok/sAMD Ryzen Threadripper PRO 5975WX 32-Cores 89,6 tok/s

MBnach Mainboard

6464843231610,01861.9333.6795.426Prefill (tok/s)Generation (tok/s)ASUSTeK COMPUTER INC. ProArt X870E-CREATOR WIFI - 510,3 tok/s Generation, 4.510 tok/s Prefill, TTFT 5.988 ms (6 Laufe)ASUSTeK COMPUTER INC....ASUSTeK COMPUTER INC. ROG STRIX B550-A GAMING - 473,9 tok/s Generation, 4.532 tok/s Prefill, TTFT 9.919 ms (3 Laufe)ASUSTeK COMPUTER INC....ASUSTeK COMPUTER INC. Pro WS WRX90E-SAGE SE - 412,6 tok/s Generation, 2.820 tok/s Prefill, TTFT 54.516 ms (28 Laufe)ASUSTeK COMPUTER INC....Meigao Innovation Technology (Shen Zhen) Co., Ltd DRFXL (MotherBoard Series) - 223,8 tok/s Generation, 2.049 tok/s Prefill, TTFT 20.233 ms (6 Laufe)Meigao Innovation Tec...ASUSTeK COMPUTER INC. Pro WS WRX80E-SAGE SE WIFI - 89,6 tok/s Generation, 1.080 tok/s Prefill, TTFT 39.623 ms (9 Laufe)ASUSTeK COMPUTER INC....
ASUSTeK COMPUTER INC. ProArt X870E-CREATOR WIFI 510,3 tok/sASUSTeK COMPUTER INC. ROG STRIX B550-A GAMING 473,9 tok/sASUSTeK COMPUTER INC. Pro WS WRX90E-SAGE SE 412,6 tok/sMeigao Innovation Technology (Shen Zhen) Co., Ltd DRFXL (MotherBoard Series) 223,8 tok/sASUSTeK COMPUTER INC. Pro WS WRX80E-SAGE SE WIFI 89,6 tok/s

ENGnach Engine

5695304924544161.8952.6313.3674.103Prefill (tok/s)Generation (tok/s)vLLM - 510,3 tok/s Generation, 3.650 tok/s Prefill, TTFT 4.952 ms (15 Laufe)vLLMllama.cpp - 474,0 tok/s Generation, 2.348 tok/s Prefill, TTFT 53.942 ms (37 Laufe)llama.cpp
vLLM 510,3 tok/sllama.cpp 474,0 tok/s

DRVnach Treiber

5615365104854592.5602.6692.7782.887Prefill (tok/s)Generation (tok/s)unbekannt - 510,3 tok/s Generation, 2.723 tok/s Prefill, TTFT 39.810 ms (52 Laufe)unbekannt
unbekannt 510,3 tok/s
Beigesteuert von

Mario Alka Administrator

@marioalka

Ich bin Unternehmer, Softwareentwickler und KI-Enthusiast. Seit vielen Jahren entwickle ich Unternehmenssoftware und beschäftige mich inzwischen fast täglich mit lokalen LLMs, KI-Agenten und leistungsfähiger KI-Hardware.

Mit LLM-Benchmark.de möchte ich eine Plattform schaffen, auf der Modelle, GPUs und Agenten objektiv und reproduzierbar miteinander verglichen werden.