Created bymario-alka.dePowered bygodcore.denoob2claw.detricoma.de
Manufacturer

Google

Gemma-Modellfamilie von Google DeepMind.

11Models
351Benchmarks
343Performance
8Harness
Best token generation
2.491,2 tok/s
gemma-4-E2B-it
Best prefill
55.259,6 tok/s
gemma-4-E2B-it
∅ Token generation
353,4 tok/s
Average of 343 runs
∅ Prefill
6.564,9 tok/s
Average of 343 runs
Best TTFT
91 ms
gemma-4-31B-it
Best harness rate
91%
Gemma-4-26B-A4B-it
🏆
gemma-4-E2B-it · fastest model at 2.491,2 tok/s token generation
Best prefill of this manufacturer: 55.259,6 tok/s (gemma-4-E2B-it)

Top models by token generation

Best measured generation throughput per model (tok/s), published performance benchmarks.

gemma-4-E2B-it
2.491,2 tok/s
gemma-4-E4B-it
1.758,6 tok/s
Gemma-4-26B-A4B-it
1.589,1 tok/s
gemma-4-12B-it
1.104,3 tok/s
Gemma-4-26B-A4B
264,1 tok/s
gemma-4-31B-it
251,1 tok/s
gemma-4-26B-A4B-it-assistant
74,5 tok/s