G
Hersteller
Google
Gemma-Modellfamilie von Google DeepMind.
Beste Token-Generierung
2.491,2 tok/s
gemma-4-E2B-it
Bester Prefill
55.259,6 tok/s
gemma-4-E2B-it
∅ Token-Generierung
353,4 tok/s
Schnitt aus 343 Läufen
∅ Prefill
6.564,9 tok/s
Schnitt aus 343 Läufen
Bester TTFT
91 ms
gemma-4-31B-it
Beste Harness-Quote
91%
Gemma-4-26B-A4B-it
🏆
gemma-4-E2B-it · schnellstes Modell mit 2.491,2 tok/s Token-Generierung
Bester Prefill des Herstellers: 55.259,6 tok/s (gemma-4-E2B-it)
Bester Prefill des Herstellers: 55.259,6 tok/s (gemma-4-E2B-it)
Top-Modelle nach Token-Generierung
Bester gemessener Generierungs-Durchsatz je Modell (tok/s), veröffentlichte Performancebenchmarks.
Modelle
Alle Benchmarks →11 zugeordnet
gemma-4-12B-it12B79 Läufe
276,2tok/s Ø
Min 22,3Max 1.104,3
gemma-4-12B-it-assistant12B0 Läufe
Noch keine Performancedaten
Gemma-4-26B-A4B26B7 Läufe
155,4tok/s Ø
Min 47,1Max 264,1
Gemma-4-26B-A4B-it26B84 Läufe
388,8tok/s Ø
Min 32,4Max 1.589,1
gemma-4-26B-A4B-it-assistant26B3 Läufe
58,3tok/s Ø
Min 33,0Max 74,5
gemma-4-31B-it31B52 Läufe
79,0tok/s Ø
Min 10,5Max 251,1
gemma-4-31B-it-assistant31B0 Läufe
Noch keine Performancedaten
gemma-4-E2B-it5B76 Läufe
557,2tok/s Ø
Min 6,8Max 2.491,2
gemma-4-E2B-it-assistant5B0 Läufe
Noch keine Performancedaten
gemma-4-E4B-it8B50 Läufe
436,1tok/s Ø
Min 37,9Max 1.758,6
gemma-4-E4B-it-assistant8B0 Läufe
Noch keine Performancedaten
