🏆
Rankings
LLM Leaderboard
Real measurements of every tested language model on real, named hardware – rated by raw speed (performance in tokens per second, prefill and time to first token) and by practical task quality in complete agent and chat runs (harness). Pick a benchmark type below or filter by model, maker and hardware to see exactly what is tested and how the results are produced.
⚡ Performance (tok/s)🤖 Harness quality👥 Concurrency🖥️ real hardware
| # | Model / Maker | Metrics | Parallel | GPU / CPU / RAM | Runtime | ||
|---|---|---|---|---|---|---|---|
| 1 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 1.335,85 tok/s TG Prefill 6.805 · TTFT 8.787 ms | 10× | NVIDIA RTX PRO 6000 Blackwell Workstation EditionAMD Ryzen 9 9950X 16-Core Processor · 92 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 2 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 1.274,68 tok/s TG Prefill 6.447 · TTFT 8.887 ms | 10× | NVIDIA RTX PRO 6000 Blackwell Workstation EditionAMD Ryzen 9 9950X 16-Core Processor · 92 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 3 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 1.229,72 tok/s TG Prefill 9.543 · TTFT 8.771 ms | 10× | 3x NVIDIA RTX PRO 6000 Blackwell Max-Q Workstation EditionAMD Ryzen Threadripper PRO 9965WX 24-Cores · 125 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 4 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 1.220,77 tok/s TG Prefill 7.425 · TTFT 9.155 ms | 10× | 3x NVIDIA RTX PRO 6000 Blackwell Max-Q Workstation EditionAMD Ryzen Threadripper PRO 9965WX 24-Cores · 125 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 5 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 1.214,90 tok/s TG Prefill 7.954 · TTFT 9.043 ms | 10× | 3x NVIDIA RTX PRO 6000 Blackwell Max-Q Workstation EditionAMD Ryzen Threadripper PRO 9965WX 24-Cores · 125 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 6 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 1.122,29 tok/s TG Prefill 5.433 · TTFT 10.439 ms | 10× | 3x NVIDIA RTX PRO 6000 Blackwell Max-Q Workstation EditionAMD Ryzen Threadripper PRO 9965WX 24-Cores · 125 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 7 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 774,35 tok/s TG Prefill 5.796 · TTFT 3.127 ms | 5× | NVIDIA RTX PRO 6000 Blackwell Workstation EditionAMD Ryzen 9 9950X 16-Core Processor · 92 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 8 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 765,17 tok/s TG Prefill 6.482 · TTFT 2.990 ms | 5× | NVIDIA RTX PRO 6000 Blackwell Workstation EditionAMD Ryzen 9 9950X 16-Core Processor · 92 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 9 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 706,49 tok/s TG Prefill 8.061 · TTFT 2.849 ms | 5× | 3x NVIDIA RTX PRO 6000 Blackwell Max-Q Workstation EditionAMD Ryzen Threadripper PRO 9965WX 24-Cores · 125 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 10 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 706,35 tok/s TG Prefill 8.636 · TTFT 2.783 ms | 5× | 3x NVIDIA RTX PRO 6000 Blackwell Max-Q Workstation EditionAMD Ryzen Threadripper PRO 9965WX 24-Cores · 125 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 11 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 704,20 tok/s TG Prefill 6.832 · TTFT 3.038 ms | 5× | 3x NVIDIA RTX PRO 6000 Blackwell Max-Q Workstation EditionAMD Ryzen Threadripper PRO 9965WX 24-Cores · 125 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 12 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 684,36 tok/s TG Prefill 4.762 · TTFT 3.642 ms | 5× | 3x NVIDIA RTX PRO 6000 Blackwell Max-Q Workstation EditionAMD Ryzen Threadripper PRO 9965WX 24-Cores · 125 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 13 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 281,92 tok/s TG Prefill 3.493 · TTFT 568 ms | 1× | NVIDIA RTX PRO 6000 Blackwell Workstation EditionAMD Ryzen 9 9950X 16-Core Processor · 92 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 14 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 251,59 tok/s TG Prefill 5.195 · TTFT 382 ms | 1× | 3x NVIDIA RTX PRO 6000 Blackwell Max-Q Workstation EditionAMD Ryzen Threadripper PRO 9965WX 24-Cores · 125 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 15 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 250,58 tok/s TG Prefill 4.273 · TTFT 463 ms | 1× | 3x NVIDIA RTX PRO 6000 Blackwell Max-Q Workstation EditionAMD Ryzen Threadripper PRO 9965WX 24-Cores · 125 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 16 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 250,33 tok/s TG Prefill 3.723 · TTFT 540 ms | 1× | 3x NVIDIA RTX PRO 6000 Blackwell Max-Q Workstation EditionAMD Ryzen Threadripper PRO 9965WX 24-Cores · 125 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 17 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 247,47 tok/s TG Prefill 3.802 · TTFT 520 ms | 1× | 3x NVIDIA RTX PRO 6000 Blackwell Max-Q Workstation EditionAMD Ryzen Threadripper PRO 9965WX 24-Cores · 125 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 18 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 216,16 tok/s TG Prefill 1.128 · TTFT 8.806 ms | 5× | 2x AMD Radeon PRO W7900 Dual SlotAMD Ryzen Threadripper PRO 5975WX 32-Cores · 247 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 19 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 209,75 tok/s TG Prefill 1.247 · TTFT 16.274 ms | 10× | 2x AMD Radeon PRO W7900 Dual SlotAMD Ryzen Threadripper PRO 5975WX 32-Cores · 247 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 20 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 107,02 tok/s TG Prefill 173 · TTFT 186.661 ms | 10× | 3x AMD Radeon AI PRO R9700AMD Ryzen Threadripper PRO 7955WX 16-Cores · 184 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 21 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 106,85 tok/s TG Prefill 172 · TTFT 186.714 ms | 10× | 3x AMD Radeon AI PRO R9700AMD Ryzen Threadripper PRO 7955WX 16-Cores · 184 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 22 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 105,39 tok/s TG Prefill 170 · TTFT 189.655 ms | 10× | 3x AMD Radeon AI PRO R9700AMD Ryzen Threadripper PRO 7955WX 16-Cores · 184 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 23 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 101,58 tok/s TG Prefill 874 · TTFT 2.364 ms | 1× | 2x AMD Radeon PRO W7900 Dual SlotAMD Ryzen Threadripper PRO 5975WX 32-Cores · 247 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 24 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 99,77 tok/s TG Prefill 1.920 · TTFT 1.022 ms | 1× | 3x AMD Radeon AI PRO R9700AMD Ryzen Threadripper PRO 7955WX 16-Cores · 184 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 25 | gpt-oss-120b120BOpenAI Performance benchmark | 99,77 tok/s TG Prefill 1.920 · TTFT 1.022 ms | 1× | 3x AMD Radeon AI PRO R970032x AMD Ryzen Threadripper PRO 7955WX 16-Cores · 184 GB RAM | godclawQ4_K_M | Details → | |
| 26 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 85,33 tok/s TG Prefill 270 · TTFT 166.013 ms | 10× | NVIDIA GeForce RTX 3090 TiAMD Ryzen 9 8945HX with Radeon Graphics · 92 GB RAM | llama.cppwebsocketQ4_K_M | Details → | |
| 27 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 63,33 tok/s TG Prefill 138 · TTFT 85.637 ms | 5× | 3x AMD Radeon AI PRO R9700AMD Ryzen Threadripper PRO 7955WX 16-Cores · 184 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 28 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 62,02 tok/s TG Prefill 136 · TTFT 86.915 ms | 5× | 3x AMD Radeon AI PRO R9700AMD Ryzen Threadripper PRO 7955WX 16-Cores · 184 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 29 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 61,91 tok/s TG Prefill 137 · TTFT 86.144 ms | 5× | 3x AMD Radeon AI PRO R9700AMD Ryzen Threadripper PRO 7955WX 16-Cores · 184 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 30 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 60,05 tok/s TG Prefill 224 · TTFT 126.906 ms | 10× | NVIDIA GeForce RTX 5070 TiAMD Ryzen Threadripper PRO 5975WX 32-Cores · 247 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 31 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 53,10 tok/s TG Prefill 190 · TTFT 71.280 ms | 5× | NVIDIA GeForce RTX 5070 TiAMD Ryzen Threadripper PRO 5975WX 32-Cores · 247 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 32 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 51,30 tok/s TG Prefill 232 · TTFT 64.035 ms | 5× | NVIDIA GeForce RTX 3090 TiAMD Ryzen 9 8945HX with Radeon Graphics · 92 GB RAM | llama.cppwebsocketQ4_K_M | Details → | |
| 33 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 42,26 tok/s TG Prefill 170 · TTFT 234.298 ms | 10× | NVIDIA GeForce RTX 5090AMD Ryzen 7 5800X3D 8-Core Processor · 126 GB RAM | llama.cppcodex_cliQ4_K_M | Details → | |
| 34 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 32,41 tok/s TG Prefill 50 · TTFT 226.449 ms | 5× | Intel Arc Pro B70AMD Ryzen 9 7945HX with Radeon Graphics · 29 GB RAM | llama.cppopenclaw_cliQ4_K_M | Details → | |
| 35 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 30,26 tok/s TG Prefill 149 · TTFT 103.687 ms | 5× | NVIDIA GeForce RTX 5090AMD Ryzen 7 5800X3D 8-Core Processor · 126 GB RAM | llama.cppcodex_cliQ4_K_M | Details → | |
| 36 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 26,57 tok/s TG Prefill 50 · TTFT 276.964 ms | 10× | Intel Arc Pro B70AMD Ryzen 9 7945HX with Radeon Graphics · 29 GB RAM | llama.cppopenclaw_cliQ4_K_M | Details → | |
| 37 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 24,08 tok/s TG Prefill 124 · TTFT 15.977 ms | 1× | 3x AMD Radeon AI PRO R9700AMD Ryzen Threadripper PRO 7955WX 16-Cores · 184 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 38 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 23,82 tok/s TG Prefill 123 · TTFT 16.131 ms | 1× | 3x AMD Radeon AI PRO R9700AMD Ryzen Threadripper PRO 7955WX 16-Cores · 184 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 39 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 23,79 tok/s TG Prefill 124 · TTFT 15.976 ms | 1× | 3x AMD Radeon AI PRO R9700AMD Ryzen Threadripper PRO 7955WX 16-Cores · 184 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 40 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 21,48 tok/s TG Prefill 4.300 · TTFT 556 ms | 1× | 3x AMD Radeon AI PRO R9700AMD Ryzen Threadripper PRO 7955WX 16-Cores · 184 GB RAM | vLLMgodclaw4-Bit | Details → | |
| 41 | gpt-oss-120b120BOpenAI Performance benchmark | 21,48 tok/s TG Prefill 4.300 · TTFT 556 ms | 1× | 3x AMD Radeon AI PRO R970032x AMD Ryzen Threadripper PRO 7955WX 16-Cores · 184 GB RAM | godclaw | Details → | |
| 42 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 21,12 tok/s TG Prefill 213 · TTFT 9.303 ms | 1× | NVIDIA GeForce RTX 3090 TiAMD Ryzen 9 8945HX with Radeon Graphics · 92 GB RAM | llama.cppwebsocketQ4_K_M | Details → | |
| 43 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 20,92 tok/s TG Prefill 170 · TTFT 11.622 ms | 1× | NVIDIA GeForce RTX 5070 TiAMD Ryzen Threadripper PRO 5975WX 32-Cores · 247 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 44 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 13,32 tok/s TG Prefill 405 · TTFT 26.375 ms | 5× | NVIDIA GeForce RTX 5090AMD Ryzen 7 5800X3D 8-Core Processor · 126 GB RAM | vLLMcodex_cli | Details → | |
| 45 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 12,82 tok/s TG Prefill 40 · TTFT 49.516 ms | 1× | Intel Arc Pro B70AMD Ryzen 9 7945HX with Radeon Graphics · 29 GB RAM | llama.cppopenclaw_cliQ4_K_M | Details → | |
| 46 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 12,57 tok/s TG Prefill 137 · TTFT 14.433 ms | 1× | NVIDIA GeForce RTX 5090AMD Ryzen 7 5800X3D 8-Core Processor · 126 GB RAM | llama.cppcodex_cliQ4_K_M | Details → | |
| 47 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 6,46 tok/s TG Prefill 333 · TTFT 6.064 ms | 1× | NVIDIA GeForce RTX 5090AMD Ryzen 7 5800X3D 8-Core Processor · 126 GB RAM | vLLMcodex_cli | Details → | |
| 48 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 5,29 tok/s TG Prefill 56 · TTFT 189.966 ms | 5× | 2x NVIDIA GeForce RTX 20604x Intel(R) Xeon(R) CPU E5-4620 v2 @ 2.60GHz · 504 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 49 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 4,46 tok/s TG Prefill 50 · TTFT 39.304 ms | 1× | 2x NVIDIA GeForce RTX 20604x Intel(R) Xeon(R) CPU E5-4620 v2 @ 2.60GHz · 504 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 50 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 0,05 tok/s TG Prefill 20 · TTFT 267.436 ms | 10× | 2x NVIDIA GeForce RTX 20604x Intel(R) Xeon(R) CPU E5-4620 v2 @ 2.60GHz · 504 GB RAM | llama.cppgodclawQ4_K_M | Details → |
