co
Modellserver / Inferenz-Engine
colibri
Alle Performance-Benchmarks, die mit diesem Modellserver gemessen wurden – Durchsatz, Prefill und Latenz.
Best generation
0,0 tok/s
glm-5.2-colibri
∅ Generation
0,0 tok/s
Schnitt aus 2 Läufen
Best prefill
211 tok/s
Prompt processing
Best TTFT
10.088 ms
Time to First Token
Top-Modelle auf colibri
Bester Durchsatz je Modell – umschaltbar nach Generation, Prefill oder Kombiwert.
Auf welcher Hardware laeuft colibri am schnellsten?
Bester Durchsatz je Grafikkarte mit diesem Modellserver.
Performance profile
Durchsatz mit colibri
Jede Blase steht für eine CPU, GPU bzw. ein Modell – Position: Prompt-Verarbeitung (X) × Ausgabe (Y), Blasengröße: Anzahl Messläufe.
All measurements
← Alle Engines2 Benchmark-Läufe
Jeder veroeffentlichte Lauf mit colibri.
| # | Model / Maker | Metrics | Parallel | GPU / CPU / RAM | Runtime | ||
|---|---|---|---|---|---|---|---|
| 1 | glm-5.2-colibri744BZ.ai (Zhipu) Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 0,03 tok/s TG Prefill 7 · TTFT 354.674 ms | 10× | NVIDIA RTX PRO 6000 Blackwell Workstation EditionAMD Ryzen 9 9950X 16-Core Processor · 92 GB RAM | colibricolibriINT4 | Details → | |
| 2 | glm-5.2-colibri744BZ.ai (Zhipu) Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 0,03 tok/s TG Prefill 211 · TTFT 10.088 ms | 1× | NVIDIA RTX PRO 6000 Blackwell Workstation EditionAMD Ryzen 9 9950X 16-Core Processor · 92 GB RAM | colibricolibriINT4 | Details → |
