Created bymario-alka.dePowered bygodcore.denoob2claw.detricoma.de
Beigesteuert vonMario AlkaQwen (Alibaba)

Qwen3.6-27B

Harnessbenchmark · gemessen am 19.07.2026 23:13

Benchmark-IDrun-20260722-161612-b91648
Tool-Parcours Dossier 40 V1.0Dense27BRuntime: godclaw
Punkte2.267,00von 5.960,00
Punktequote38,04%
Aufgaben bestanden38von 40
Gesamtdauer10.331,00s
Einordnung im Feld
11von 12 Systemen

Harnessbenchmark · Leitmetrik: Punktequote (%)

Dieser Lauf ist besser als 9 % aller vergleichbaren Systeme.
Punktequote 38 %
-35 % vs Ø 58,8
Aufgaben bestanden 38
+143 % vs Ø 15,7
Gesamtdauer 10.331,0 s
+480 % vs Ø 1.780,3
Verteilung im Feld10 – 91 %
Ø 59 Median Dieser Lauf

Wie schlägt sich dieser Benchmark mit anderen Modellen?

Hardware

GPU: NVIDIA RTX PRO 6000 Blackwell Max-Q Workstation Edition · 96 GB VRAM
CPU: AMD Ryzen 9 9950X 16-Core Processor
RAM: 92 GB
Mainboard: ASUSTeK COMPUTER INC. ProArt X870E-CREATOR WIFI

Setup

Runtime: godclaw
Quantisierung: -
Modell: Qwen3.6-27B

Aufgaben (40)

AufgabeStatusPunkteDauer
Arbeitsstruktur anlegenbestanden5 / 507.222,00 s
Startdatei schreibenbestanden6 / 6041,00 s
Datei zuruecklesenfehlgeschlagen0 / 501.452,00 s
CSV mit Testdatenbestanden13 / 8028,00 s
Struktur pruefenbestanden6 / 6020,00 s
Recherche RAGbestanden96 / 15024,00 s
Recherche Herstellerbestanden72 / 12020,00 s
Recherche sichernbestanden25 / 10025,00 s
Webseite auswertenbestanden14 / 14096,00 s
Seite im Browser oeffnenbestanden25 / 18086,00 s
Modellvergleichbestanden78 / 20051,00 s
Quellenlistebestanden17 / 9027,00 s
Wissenskategorien sichtenbestanden52 / 10016,00 s
Wissenseintrag anlegenbestanden114 / 22040,00 s
Wissenseintrag pruefenbestanden53 / 12025,00 s
Wissenseintrag ergaenzenbestanden80 / 20040,00 s
Versionen zaehlenbestanden81 / 14021,00 s
Wissen durchsuchenbestanden29 / 13039,00 s
Firma erfassenbestanden123 / 18021,00 s
Person verknuepfenbestanden117 / 22039,00 s
Fakt hinterlegenbestanden16 / 160103,00 s
Entitaet suchenbestanden17 / 14044,00 s
Aufgabenliste anlegenbestanden89 / 13014,00 s
Aufgaben ergaenzenbestanden114 / 17022,00 s
Boards sichtenbestanden47 / 12027,00 s
Board-Aufgabe anlegenbestanden19 / 190158,00 s
CSV nach JSONbestanden86 / 18035,00 s
JSON validierenbestanden81 / 14021,00 s
Defektes JSON reparierenbestanden120 / 22038,00 s
Pruefsummenbestanden53 / 16037,00 s
Volltextsuchebestanden66 / 15028,00 s
Archiv packenbestanden106 / 17025,00 s
Bestandsaufnahmebestanden12 / 12041,00 s
Titelbild erzeugenbestanden154 / 25051,00 s
Bild pruefenbestanden83 / 13018,00 s
Merkenbestanden75 / 15025,00 s
Erinnernbestanden42 / 12029,00 s
Fachfrage delegierenbestanden23 / 230166,00 s
Gesamtberichtbestanden58 / 24076,00 s
Abschlussfehlgeschlagen0 / 20040,00 s

Konfiguration

benchmark-konfiguration — run-20260722-161612-b91648
# LLM-Benchmark Konfiguration # Modell : Qwen3.6-27B # Engine : vLLM # Run-ID : run-20260722-161612-b91648 # GPU : NVIDIA RTX PRO 6000 Blackwell Max-Q Workstation Edition # CPU : AMD Ryzen 9 9950X 16-Core Processor # RAM : 92 GB bench@llm-benchmark:~$ python \ -m vllm.entrypoints.openai.api_server \ --model Qwen/Qwen3.6-27B \ --served-model-name Qwen/Qwen3.6-27B \ --host 0.0.0.0 \ --port 8000 \ --gpu-memory-utilization 0.90 \ --max-model-len 65536 \ --generation-config vllm \ --language-model-only \ --reasoning-parser qwen3 \ --enable-auto-tool-choice \ --tool-call-parser qwen3_coder
Engine?Die Inferenz-Software, die das Modell ausliefert (z.B. vLLM oder llama.cpp). Sie bestimmt Geschwindigkeit, unterstuetzte Modellformate und welche Parameter ueberhaupt verfuegbar sind.vllm
Modellalias?Der Name, unter dem das Modell ueber die API angesprochen wird. Genau dieser Wert muss im Request-Feld 'model' stehen.Qwen/Qwen3.6-27B
Kontextlaenge?Maximale Anzahl Tokens (Eingabe + erzeugte Ausgabe zusammen), die das Modell pro Anfrage verarbeiten kann.65536
Python-Modul?Startet vLLM als Python-Modul (python -m vllm.entrypoints.openai.api_server). Der folgende Wert ist der Modulname.vllm.entrypoints.openai.api_server
Modellpfad?Pfad zur GGUF-Modelldatei, die geladen und ausgeliefert wird.Qwen/Qwen3.6-27B
Alias?Anzeigename des Modells nach aussen (served model name), unabhaengig vom Dateinamen.Qwen/Qwen3.6-27B
GPU-Speicher?Anteil des GPU-Speichers (0 bis 1), den vLLM belegen darf. 0.92 = 92 %. Hoeher = mehr Platz fuer den KV-Cache (mehr/laengere parallele Anfragen), aber groesseres Risiko fuer 'Out of Memory'.0.90
Kontext?Groesse des Kontextfensters in Token. 0 = der beim Training verwendete Kontext des Modells.65536
Generation-Config?Quelle der Default-Sampling-Parameter (auto/vllm oder Pfad). Steuert die vom Modell vorgegebenen Defaults fuer temperature/top_p usw.vllm
Nur-Sprachmodell?Laedt bei multimodalen Modellen nur den Sprachteil. Spart VRAM, deaktiviert aber Bild-/Audio-Eingabe.aktiv
Reasoning-Parser?Trennt den Denk-/Reasoning-Teil der Antwort vom eigentlichen Inhalt (z.B. bei Modellen mit <think>-Bloecken).qwen3
Auto-Tool-Choice?Erlaubt dem Modell, Tools (Function-Calling) selbststaendig auszuwaehlen. MUSS aktiv sein, damit 'tools' im Request akzeptiert werden - sonst lehnt vLLM sie mit HTTP 400 ab.aktiv
Tool-Parser?Bestimmt, wie vLLM Tool-Aufrufe aus der Modellantwort ausliest (z.B. hermes, mistral, llama3_json). Muss zum Modell passen.qwen3_coder

Alle Benchmarks dieses Modells Zum Leaderboard

Anzeige
Modell-Vergleich

Qwen3.6-27B auf verschiedener Hardware

Alle veröffentlichten Performance-Läufe dieses Modells – jede Blase eine Variante: Position = Prefill (X) × Generation (Y), Blasengröße = Anzahl Läufe. Näher oben rechts = schneller. ★ Gold markiert = dieser Benchmark.

GPUnach Grafikkarte

7045283521760,001.1052.2103.315Prefill (tok/s)Generation (tok/s)NVIDIA RTX PRO 6000 Blackwell Workstation Edition - 546,9 tok/s Generation, 2.739 tok/s Prefill, TTFT 9.126 ms (3 Laufe)NVIDIA RTX PRO 6000 B...NVIDIA GeForce RTX 5090 - 532,5 tok/s Generation, 2.539 tok/s Prefill, TTFT 9.812 ms (3 Laufe)NVIDIA GeForce RTX 50...NVIDIA RTX A6000 - 431,7 tok/s Generation, 2.362 tok/s Prefill, TTFT 8.109 ms (27 Laufe)NVIDIA RTX A6000NVIDIA GeForce RTX 3090 Ti - 264,2 tok/s Generation, 1.458 tok/s Prefill, TTFT 19.358 ms (3 Laufe)NVIDIA GeForce RTX 30...AMD Radeon AI PRO R9700 - 165,4 tok/s Generation, 1.380 tok/s Prefill, TTFT 28.271 ms (9 Laufe)AMD Radeon AI PRO R97...AMD Radeon PRO W7800 48GB - 106,8 tok/s Generation, 600 tok/s Prefill, TTFT 12.996 ms (4 Laufe)AMD Radeon PRO W7800 ...NVIDIA GeForce RTX 5070 Ti - 57,2 tok/s Generation, 447 tok/s Prefill, TTFT 80.318 ms (3 Laufe)NVIDIA GeForce RTX 50...AMD Radeon 8060S Graphics - 36,1 tok/s Generation, 536 tok/s Prefill, TTFT 41.917 ms (1 Lauf)AMD Radeon 8060S Grap...NVIDIA RTX PRO 6000 Blackwell Max-Q Workstation Edition - 464,1 tok/s Generation, 2.737 tok/s Prefill, TTFT 9.091 ms (11 Laufe) | DIESER LAUF★ NVIDIA RTX PRO 6000 B...
NVIDIA RTX PRO 6000 Blackwell Workstation Edition 546,9 tok/sNVIDIA GeForce RTX 5090 532,5 tok/s★ NVIDIA RTX PRO 6000 Blackwell Max-Q Workstation Edition 464,1 tok/s dieser LaufNVIDIA RTX A6000 431,7 tok/sNVIDIA GeForce RTX 3090 Ti 264,2 tok/sAMD Radeon AI PRO R9700 165,4 tok/sAMD Radeon PRO W7800 48GB 106,8 tok/sNVIDIA GeForce RTX 5070 Ti 57,2 tok/sAMD Radeon 8060S Graphics 36,1 tok/s

CPUnach Prozessor

7045283521760,001.2962.5913.887Prefill (tok/s)Generation (tok/s)AMD Ryzen 7 5800X3D 8-Core Processor - 532,5 tok/s Generation, 2.539 tok/s Prefill, TTFT 9.812 ms (3 Laufe)AMD Ryzen 7 5800X3D 8...AMD Ryzen Threadripper PRO 9965WX 24-Cores - 464,1 tok/s Generation, 3.212 tok/s Prefill, TTFT 11.084 ms (9 Laufe)AMD Ryzen Threadrippe...AMD Ryzen Threadripper PRO 7955WX 16-Cores - 431,7 tok/s Generation, 2.117 tok/s Prefill, TTFT 13.149 ms (36 Laufe)AMD Ryzen Threadrippe...AMD Ryzen 9 8945HX with Radeon Graphics - 264,2 tok/s Generation, 1.458 tok/s Prefill, TTFT 19.358 ms (3 Laufe)AMD Ryzen 9 8945HX wi...AMD Ryzen Threadripper PRO 5975WX 32-Cores - 106,8 tok/s Generation, 534 tok/s Prefill, TTFT 41.848 ms (7 Laufe)AMD Ryzen Threadrippe...AMD RYZEN AI MAX+ 395 w/ Radeon 8060S - 36,1 tok/s Generation, 536 tok/s Prefill, TTFT 41.917 ms (1 Lauf)AMD RYZEN AI MAX+ 395...AMD Ryzen 9 9950X 16-Core Processor - 546,9 tok/s Generation, 1.883 tok/s Prefill, TTFT 5.524 ms (5 Laufe) | DIESER LAUF★ AMD Ryzen 9 9950X 16-...
★ AMD Ryzen 9 9950X 16-Core Processor 546,9 tok/s dieser LaufAMD Ryzen 7 5800X3D 8-Core Processor 532,5 tok/sAMD Ryzen Threadripper PRO 9965WX 24-Cores 464,1 tok/sAMD Ryzen Threadripper PRO 7955WX 16-Cores 431,7 tok/sAMD Ryzen 9 8945HX with Radeon Graphics 264,2 tok/sAMD Ryzen Threadripper PRO 5975WX 32-Cores 106,8 tok/sAMD RYZEN AI MAX+ 395 w/ Radeon 8060S 36,1 tok/s

MBnach Mainboard

7055293531760,0211.0312.0423.052Prefill (tok/s)Generation (tok/s)ASUSTeK COMPUTER INC. ROG STRIX B550-A GAMING - 532,5 tok/s Generation, 2.539 tok/s Prefill, TTFT 9.812 ms (3 Laufe)ASUSTeK COMPUTER INC....ASUSTeK COMPUTER INC. Pro WS WRX90E-SAGE SE - 464,1 tok/s Generation, 2.336 tok/s Prefill, TTFT 12.736 ms (45 Laufe)ASUSTeK COMPUTER INC....Meigao Innovation Technology (Shen Zhen) Co., Ltd DRFXL (MotherBoard Series) - 264,2 tok/s Generation, 1.458 tok/s Prefill, TTFT 19.358 ms (3 Laufe)Meigao Innovation Tec...ASUSTeK COMPUTER INC. Pro WS WRX80E-SAGE SE WIFI - 106,8 tok/s Generation, 534 tok/s Prefill, TTFT 41.848 ms (7 Laufe)ASUSTeK COMPUTER INC....Bosgame AXB35-02 (BeyondMax Series) - 36,1 tok/s Generation, 536 tok/s Prefill, TTFT 41.917 ms (1 Lauf)Bosgame AXB35-02 (Bey...unbekannt - 28,8 tok/s Generation, 599 tok/s Prefill, TTFT 122 ms (1 Lauf)unbekanntASUSTeK COMPUTER INC. ProArt X870E-CREATOR WIFI - 546,9 tok/s Generation, 2.204 tok/s Prefill, TTFT 6.875 ms (4 Laufe) | DIESER LAUF★ ASUSTeK COMPUTER INC....
★ ASUSTeK COMPUTER INC. ProArt X870E-CREATOR WIFI 546,9 tok/s dieser LaufASUSTeK COMPUTER INC. ROG STRIX B550-A GAMING 532,5 tok/sASUSTeK COMPUTER INC. Pro WS WRX90E-SAGE SE 464,1 tok/sMeigao Innovation Technology (Shen Zhen) Co., Ltd DRFXL (MotherBoard Series) 264,2 tok/sASUSTeK COMPUTER INC. Pro WS WRX80E-SAGE SE WIFI 106,8 tok/sBosgame AXB35-02 (BeyondMax Series) 36,1 tok/sunbekannt 28,8 tok/s

ENGnach Engine

7055293531760,001.6393.2784.917Prefill (tok/s)Generation (tok/s)llama.cpp - 546,9 tok/s Generation, 1.692 tok/s Prefill, TTFT 18.794 ms (53 Laufe)llama.cppunbekannt - 28,8 tok/s Generation, 599 tok/s Prefill, TTFT 122 ms (1 Lauf)unbekanntvLLM - 431,7 tok/s Generation, 4.052 tok/s Prefill, TTFT 2.692 ms (10 Laufe) | DIESER LAUF★ vLLM
llama.cpp 546,9 tok/s★ vLLM 431,7 tok/s dieser Laufunbekannt 28,8 tok/s

DRVnach Treiber

7055293531760,02119591.7072.455Prefill (tok/s)Generation (tok/s)unbekannt - 546,9 tok/s Generation, 2.067 tok/s Prefill, TTFT 16.238 ms (63 Laufe)unbekanntNVIDIA 580.159.03 / CUDA 13.0 - 28,8 tok/s Generation, 599 tok/s Prefill, TTFT 122 ms (1 Lauf)NVIDIA 580.159.03 / C...
unbekannt 546,9 tok/sNVIDIA 580.159.03 / CUDA 13.0 28,8 tok/s
Beigesteuert von

Mario Alka Administrator

@marioalka

Ich bin Unternehmer, Softwareentwickler und KI-Enthusiast. Seit vielen Jahren entwickle ich Unternehmenssoftware und beschäftige mich inzwischen fast täglich mit lokalen LLMs, KI-Agenten und leistungsfähiger KI-Hardware.

Mit LLM-Benchmark.de möchte ich eine Plattform schaffen, auf der Modelle, GPUs und Agenten objektiv und reproduzierbar miteinander verglichen werden.