Created bymario-alka.dePowered bygodcore.denoob2claw.detricoma.de
Hersteller

Google

Gemma-Modellfamilie von Google DeepMind.

3Modelle
13Benchmarks
5Performance
8Harness
Beste Token-Generierung
42,2 tok/s
Gemma-4-26B-A4B-it
Bester Prefill
308,7 tok/s
gemma-4-31b-it-int8
∅ Token-Generierung
20,2 tok/s
Schnitt aus 5 Laeufen
∅ Prefill
189,6 tok/s
Schnitt aus 5 Laeufen
Bester TTFT
91 ms
gemma-4-31b-it-int8
Beste Harness-Quote
91%
Gemma-4-26B-A4B-it
🏆
Gemma-4-26B-A4B-it · schnellstes Modell mit 42,2 tok/s Token-Generierung
Bester Prefill des Herstellers: 308,7 tok/s (gemma-4-31b-it-int8)

Top-Modelle nach Token-Generierung

Bester gemessener Generierungs-Durchsatz je Modell (tok/s), veroeffentlichte Performancebenchmarks.

Gemma-4-26B-A4B-it
42,2 tok/s
gemma-4-31b-it-int8
24,4 tok/s