Engines
Engine overview
How the models are run and tested – split into model servers (inference engines) and harness runtimes.
⚙️ Inference
Model servers (4)
Engines that serve the model – average throughput per server.
🚀 Harness
Harness runtimes (2)
Test runtimes for agent/chat benchmarks – average success rate.
🖥️ Operating systems
Operating systems (3)
These OS platforms the benchmarks were measured on – click for a landing page per operating system.
