Google
gemma-4-26B-A4B-it-assistant26B
Benchmarkprofil und veröffentlichte Ergebnisse.
MoE26B
Einordnung im Feld
Bestwerte im Vergleich
Beste Messwerte dieses Modells gegen Minimum, Durchschnitt und Maximum aller veröffentlichten Systeme.
Generation74,5 tok/s
Min 0,0Ø 248,0Max 2.491,2
Unter dem Durchschnitt · 3978 Systeme im Feld
Prefill867 tok/s
Min 4Ø 4.741Max 55.260
Unter dem Durchschnitt · 3978 Systeme im Feld
Time to First Token2.545 ms
Min 20Ø 33.893Max 535.235
Ueber dem Durchschnitt · 3976 Systeme im Feld
Performanceprofil
Durchsatz nach Hardware & Engine
Jede Blase steht für eine GPU, CPU bzw. Engine – die Position zeigt Prompt-Verarbeitung (X) und Ausgabe-Geschwindigkeit (Y), die Blasengröße die Anzahl der Messläufe.
Durchsatz & Latenz
Performancebenchmark
| # | Modell / Hersteller | Messwerte | Parallel | GPU / CPU / RAM | Runtime | ||
|---|---|---|---|---|---|---|---|
| 1 | gemma-4-26B-A4B-it-assistant26BGoogle PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 74,51 tok/s TG Prefill 867 · TTFT 23.582 ms | 10× | AMD Radeon 8060S GraphicsAMD RYZEN AI MAX+ 395 w/ Radeon 8060S · 31 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 2 | gemma-4-26B-A4B-it-assistant26BGoogle PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 67,34 tok/s TG Prefill 795 · TTFT 12.430 ms | 5× | AMD Radeon 8060S GraphicsAMD RYZEN AI MAX+ 395 w/ Radeon 8060S · 31 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 3 | gemma-4-26B-A4B-it-assistant26BGoogle PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 32,97 tok/s TG Prefill 777 · TTFT 2.545 ms | 1× | AMD Radeon 8060S GraphicsAMD RYZEN AI MAX+ 395 w/ Radeon 8060S · 31 GB RAM | llama.cppgodclawQ4_K_M | Details → |
Agent- & Chat-Bewertung
Harnessbenchmark
Noch keine Harnessbenchmarks fuer dieses Modell.
