G
Hersteller
Google
Gemma-Modellfamilie von Google DeepMind.
Beste Token-Generierung
42,2 tok/s
Gemma-4-26B-A4B-it
Bester Prefill
308,7 tok/s
gemma-4-31b-it-int8
∅ Token-Generierung
20,2 tok/s
Schnitt aus 5 Laeufen
∅ Prefill
189,6 tok/s
Schnitt aus 5 Laeufen
Bester TTFT
91 ms
gemma-4-31b-it-int8
Beste Harness-Quote
91%
Gemma-4-26B-A4B-it
🏆
Gemma-4-26B-A4B-it · schnellstes Modell mit 42,2 tok/s Token-Generierung
Bester Prefill des Herstellers: 308,7 tok/s (gemma-4-31b-it-int8)
Bester Prefill des Herstellers: 308,7 tok/s (gemma-4-31b-it-int8)
Top-Modelle nach Token-Generierung
Bester gemessener Generierungs-Durchsatz je Modell (tok/s), veroeffentlichte Performancebenchmarks.
