Created bymario-alka.dePowered bygodcore.denoob2claw.detricoma.de
Hersteller

Google

Gemma-Modellfamilie von Google DeepMind.

11Modelle
351Benchmarks
343Performance
8Harness
Beste Token-Generierung
2.491,2 tok/s
gemma-4-E2B-it
Bester Prefill
55.259,6 tok/s
gemma-4-E2B-it
∅ Token-Generierung
353,4 tok/s
Schnitt aus 343 Läufen
∅ Prefill
6.564,9 tok/s
Schnitt aus 343 Läufen
Bester TTFT
91 ms
gemma-4-31B-it
Beste Harness-Quote
91%
Gemma-4-26B-A4B-it
🏆
gemma-4-E2B-it · schnellstes Modell mit 2.491,2 tok/s Token-Generierung
Bester Prefill des Herstellers: 55.259,6 tok/s (gemma-4-E2B-it)

Top-Modelle nach Token-Generierung

Bester gemessener Generierungs-Durchsatz je Modell (tok/s), veröffentlichte Performancebenchmarks.

gemma-4-E2B-it
2.491,2 tok/s
gemma-4-E4B-it
1.758,6 tok/s
Gemma-4-26B-A4B-it
1.589,1 tok/s
gemma-4-12B-it
1.104,3 tok/s
Gemma-4-26B-A4B
264,1 tok/s
gemma-4-31B-it
251,1 tok/s
gemma-4-26B-A4B-it-assistant
74,5 tok/s