OpenAI
gpt-oss-120b120B
Benchmark profile and published results.
MoE120B
Position in the field
Best values compared
Best metrics of this model against the minimum, average and maximum of all published systems.
Generation1.335,9 tok/s
Min 0,0Ø 248,3Max 2.491,2
Ueber dem Durchschnitt · 3969 Systeme im Feld
Prefill9.543 tok/s
Min 4Ø 4.741Max 55.260
Ueber dem Durchschnitt · 3969 Systeme im Feld
Time to First Token382 ms
Min 20Ø 33.962Max 535.235
Ueber dem Durchschnitt · 3967 Systeme im Feld
Performance profile
Throughput by hardware & engine
Each bubble is a GPU, CPU or engine – position shows prompt processing (X) and output speed (Y), bubble size the number of runs.
GPUby graphics card
NVIDIA RTX PRO 6000 Blackwell Workstation Edition 1.335,9 tok/sNVIDIA RTX PRO 6000 Blackwell Max-Q Workstation Edition 1.229,7 tok/sAMD Radeon PRO W7900 Dual Slot 216,2 tok/sAMD Radeon AI PRO R9700 107,0 tok/sNVIDIA GeForce RTX 3090 Ti 85,3 tok/sNVIDIA GeForce RTX 5070 Ti 60,1 tok/sNVIDIA GeForce RTX 5090 42,3 tok/sIntel Arc Pro B70 32,4 tok/sNVIDIA GeForce RTX 2060 5,3 tok/s
CPUby processor
AMD Ryzen 9 9950X 16-Core Processor 1.335,9 tok/sAMD Ryzen Threadripper PRO 9965WX 24-Cores 1.229,7 tok/sAMD Ryzen Threadripper PRO 5975WX 32-Cores 216,2 tok/sAMD Ryzen Threadripper PRO 7955WX 16-Cores 107,0 tok/sAMD Ryzen 9 8945HX with Radeon Graphics 85,3 tok/sAMD Ryzen 7 5800X3D 8-Core Processor 42,3 tok/sAMD Ryzen 9 7945HX with Radeon Graphics 32,4 tok/sIntel(R) Xeon(R) CPU E5-4620 v2 @ 2.60GHz 5,3 tok/s
Throughput & latency
Performance benchmark
| # | Model / Maker | Metrics | Parallel | GPU / CPU / RAM | Runtime | ||
|---|---|---|---|---|---|---|---|
| 1 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 1.335,85 tok/s TG Prefill 6.805 · TTFT 8.787 ms | 10× | NVIDIA RTX PRO 6000 Blackwell Workstation EditionAMD Ryzen 9 9950X 16-Core Processor · 92 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 2 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 1.274,68 tok/s TG Prefill 6.447 · TTFT 8.887 ms | 10× | NVIDIA RTX PRO 6000 Blackwell Workstation EditionAMD Ryzen 9 9950X 16-Core Processor · 92 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 3 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 1.229,72 tok/s TG Prefill 9.543 · TTFT 8.771 ms | 10× | 3x NVIDIA RTX PRO 6000 Blackwell Max-Q Workstation EditionAMD Ryzen Threadripper PRO 9965WX 24-Cores · 125 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 4 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 1.220,77 tok/s TG Prefill 7.425 · TTFT 9.155 ms | 10× | 3x NVIDIA RTX PRO 6000 Blackwell Max-Q Workstation EditionAMD Ryzen Threadripper PRO 9965WX 24-Cores · 125 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 5 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 1.214,90 tok/s TG Prefill 7.954 · TTFT 9.043 ms | 10× | 3x NVIDIA RTX PRO 6000 Blackwell Max-Q Workstation EditionAMD Ryzen Threadripper PRO 9965WX 24-Cores · 125 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 6 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 1.122,29 tok/s TG Prefill 5.433 · TTFT 10.439 ms | 10× | 3x NVIDIA RTX PRO 6000 Blackwell Max-Q Workstation EditionAMD Ryzen Threadripper PRO 9965WX 24-Cores · 125 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 7 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 774,35 tok/s TG Prefill 5.796 · TTFT 3.127 ms | 5× | NVIDIA RTX PRO 6000 Blackwell Workstation EditionAMD Ryzen 9 9950X 16-Core Processor · 92 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 8 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 765,17 tok/s TG Prefill 6.482 · TTFT 2.990 ms | 5× | NVIDIA RTX PRO 6000 Blackwell Workstation EditionAMD Ryzen 9 9950X 16-Core Processor · 92 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 9 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 706,49 tok/s TG Prefill 8.061 · TTFT 2.849 ms | 5× | 3x NVIDIA RTX PRO 6000 Blackwell Max-Q Workstation EditionAMD Ryzen Threadripper PRO 9965WX 24-Cores · 125 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 10 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 706,35 tok/s TG Prefill 8.636 · TTFT 2.783 ms | 5× | 3x NVIDIA RTX PRO 6000 Blackwell Max-Q Workstation EditionAMD Ryzen Threadripper PRO 9965WX 24-Cores · 125 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 11 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 704,20 tok/s TG Prefill 6.832 · TTFT 3.038 ms | 5× | 3x NVIDIA RTX PRO 6000 Blackwell Max-Q Workstation EditionAMD Ryzen Threadripper PRO 9965WX 24-Cores · 125 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 12 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 684,36 tok/s TG Prefill 4.762 · TTFT 3.642 ms | 5× | 3x NVIDIA RTX PRO 6000 Blackwell Max-Q Workstation EditionAMD Ryzen Threadripper PRO 9965WX 24-Cores · 125 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 13 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 281,92 tok/s TG Prefill 3.493 · TTFT 568 ms | 1× | NVIDIA RTX PRO 6000 Blackwell Workstation EditionAMD Ryzen 9 9950X 16-Core Processor · 92 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 14 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 251,59 tok/s TG Prefill 5.195 · TTFT 382 ms | 1× | 3x NVIDIA RTX PRO 6000 Blackwell Max-Q Workstation EditionAMD Ryzen Threadripper PRO 9965WX 24-Cores · 125 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 15 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 250,58 tok/s TG Prefill 4.273 · TTFT 463 ms | 1× | 3x NVIDIA RTX PRO 6000 Blackwell Max-Q Workstation EditionAMD Ryzen Threadripper PRO 9965WX 24-Cores · 125 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 16 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 250,33 tok/s TG Prefill 3.723 · TTFT 540 ms | 1× | 3x NVIDIA RTX PRO 6000 Blackwell Max-Q Workstation EditionAMD Ryzen Threadripper PRO 9965WX 24-Cores · 125 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 17 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 247,47 tok/s TG Prefill 3.802 · TTFT 520 ms | 1× | 3x NVIDIA RTX PRO 6000 Blackwell Max-Q Workstation EditionAMD Ryzen Threadripper PRO 9965WX 24-Cores · 125 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 18 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 216,16 tok/s TG Prefill 1.128 · TTFT 8.806 ms | 5× | 2x AMD Radeon PRO W7900 Dual SlotAMD Ryzen Threadripper PRO 5975WX 32-Cores · 247 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 19 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 209,75 tok/s TG Prefill 1.247 · TTFT 16.274 ms | 10× | 2x AMD Radeon PRO W7900 Dual SlotAMD Ryzen Threadripper PRO 5975WX 32-Cores · 247 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 20 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 107,02 tok/s TG Prefill 173 · TTFT 186.661 ms | 10× | 3x AMD Radeon AI PRO R9700AMD Ryzen Threadripper PRO 7955WX 16-Cores · 184 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 21 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 106,85 tok/s TG Prefill 172 · TTFT 186.714 ms | 10× | 3x AMD Radeon AI PRO R9700AMD Ryzen Threadripper PRO 7955WX 16-Cores · 184 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 22 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 105,39 tok/s TG Prefill 170 · TTFT 189.655 ms | 10× | 3x AMD Radeon AI PRO R9700AMD Ryzen Threadripper PRO 7955WX 16-Cores · 184 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 23 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 101,58 tok/s TG Prefill 874 · TTFT 2.364 ms | 1× | 2x AMD Radeon PRO W7900 Dual SlotAMD Ryzen Threadripper PRO 5975WX 32-Cores · 247 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 24 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 99,77 tok/s TG Prefill 1.920 · TTFT 1.022 ms | 1× | 3x AMD Radeon AI PRO R9700AMD Ryzen Threadripper PRO 7955WX 16-Cores · 184 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 25 | gpt-oss-120b120BOpenAI Performance benchmark | 99,77 tok/s TG Prefill 1.920 · TTFT 1.022 ms | 1× | 3x AMD Radeon AI PRO R970032x AMD Ryzen Threadripper PRO 7955WX 16-Cores · 184 GB RAM | godclawQ4_K_M | Details → | |
| 26 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 85,33 tok/s TG Prefill 270 · TTFT 166.013 ms | 10× | NVIDIA GeForce RTX 3090 TiAMD Ryzen 9 8945HX with Radeon Graphics · 92 GB RAM | llama.cppwebsocketQ4_K_M | Details → | |
| 27 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 63,33 tok/s TG Prefill 138 · TTFT 85.637 ms | 5× | 3x AMD Radeon AI PRO R9700AMD Ryzen Threadripper PRO 7955WX 16-Cores · 184 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 28 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 62,02 tok/s TG Prefill 136 · TTFT 86.915 ms | 5× | 3x AMD Radeon AI PRO R9700AMD Ryzen Threadripper PRO 7955WX 16-Cores · 184 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 29 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 61,91 tok/s TG Prefill 137 · TTFT 86.144 ms | 5× | 3x AMD Radeon AI PRO R9700AMD Ryzen Threadripper PRO 7955WX 16-Cores · 184 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 30 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 60,05 tok/s TG Prefill 224 · TTFT 126.906 ms | 10× | NVIDIA GeForce RTX 5070 TiAMD Ryzen Threadripper PRO 5975WX 32-Cores · 247 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 31 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 53,10 tok/s TG Prefill 190 · TTFT 71.280 ms | 5× | NVIDIA GeForce RTX 5070 TiAMD Ryzen Threadripper PRO 5975WX 32-Cores · 247 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 32 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 51,30 tok/s TG Prefill 232 · TTFT 64.035 ms | 5× | NVIDIA GeForce RTX 3090 TiAMD Ryzen 9 8945HX with Radeon Graphics · 92 GB RAM | llama.cppwebsocketQ4_K_M | Details → | |
| 33 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 42,26 tok/s TG Prefill 170 · TTFT 234.298 ms | 10× | NVIDIA GeForce RTX 5090AMD Ryzen 7 5800X3D 8-Core Processor · 126 GB RAM | llama.cppcodex_cliQ4_K_M | Details → | |
| 34 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 32,41 tok/s TG Prefill 50 · TTFT 226.449 ms | 5× | Intel Arc Pro B70AMD Ryzen 9 7945HX with Radeon Graphics · 29 GB RAM | llama.cppopenclaw_cliQ4_K_M | Details → | |
| 35 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 30,26 tok/s TG Prefill 149 · TTFT 103.687 ms | 5× | NVIDIA GeForce RTX 5090AMD Ryzen 7 5800X3D 8-Core Processor · 126 GB RAM | llama.cppcodex_cliQ4_K_M | Details → | |
| 36 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 26,57 tok/s TG Prefill 50 · TTFT 276.964 ms | 10× | Intel Arc Pro B70AMD Ryzen 9 7945HX with Radeon Graphics · 29 GB RAM | llama.cppopenclaw_cliQ4_K_M | Details → | |
| 37 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 24,08 tok/s TG Prefill 124 · TTFT 15.977 ms | 1× | 3x AMD Radeon AI PRO R9700AMD Ryzen Threadripper PRO 7955WX 16-Cores · 184 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 38 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 23,82 tok/s TG Prefill 123 · TTFT 16.131 ms | 1× | 3x AMD Radeon AI PRO R9700AMD Ryzen Threadripper PRO 7955WX 16-Cores · 184 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 39 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 23,79 tok/s TG Prefill 124 · TTFT 15.976 ms | 1× | 3x AMD Radeon AI PRO R9700AMD Ryzen Threadripper PRO 7955WX 16-Cores · 184 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 40 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 21,48 tok/s TG Prefill 4.300 · TTFT 556 ms | 1× | 3x AMD Radeon AI PRO R9700AMD Ryzen Threadripper PRO 7955WX 16-Cores · 184 GB RAM | vLLMgodclaw4-Bit | Details → | |
| 41 | gpt-oss-120b120BOpenAI Performance benchmark | 21,48 tok/s TG Prefill 4.300 · TTFT 556 ms | 1× | 3x AMD Radeon AI PRO R970032x AMD Ryzen Threadripper PRO 7955WX 16-Cores · 184 GB RAM | godclaw | Details → | |
| 42 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 21,12 tok/s TG Prefill 213 · TTFT 9.303 ms | 1× | NVIDIA GeForce RTX 3090 TiAMD Ryzen 9 8945HX with Radeon Graphics · 92 GB RAM | llama.cppwebsocketQ4_K_M | Details → | |
| 43 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 20,92 tok/s TG Prefill 170 · TTFT 11.622 ms | 1× | NVIDIA GeForce RTX 5070 TiAMD Ryzen Threadripper PRO 5975WX 32-Cores · 247 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 44 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 13,32 tok/s TG Prefill 405 · TTFT 26.375 ms | 5× | NVIDIA GeForce RTX 5090AMD Ryzen 7 5800X3D 8-Core Processor · 126 GB RAM | vLLMcodex_cli | Details → | |
| 45 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 12,82 tok/s TG Prefill 40 · TTFT 49.516 ms | 1× | Intel Arc Pro B70AMD Ryzen 9 7945HX with Radeon Graphics · 29 GB RAM | llama.cppopenclaw_cliQ4_K_M | Details → | |
| 46 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 12,57 tok/s TG Prefill 137 · TTFT 14.433 ms | 1× | NVIDIA GeForce RTX 5090AMD Ryzen 7 5800X3D 8-Core Processor · 126 GB RAM | llama.cppcodex_cliQ4_K_M | Details → | |
| 47 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 6,46 tok/s TG Prefill 333 · TTFT 6.064 ms | 1× | NVIDIA GeForce RTX 5090AMD Ryzen 7 5800X3D 8-Core Processor · 126 GB RAM | vLLMcodex_cli | Details → | |
| 48 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 5,29 tok/s TG Prefill 56 · TTFT 189.966 ms | 5× | 2x NVIDIA GeForce RTX 20604x Intel(R) Xeon(R) CPU E5-4620 v2 @ 2.60GHz · 504 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 49 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 4,46 tok/s TG Prefill 50 · TTFT 39.304 ms | 1× | 2x NVIDIA GeForce RTX 20604x Intel(R) Xeon(R) CPU E5-4620 v2 @ 2.60GHz · 504 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 50 | gpt-oss-120b120BOpenAI Performance benchmarkTimebench 3 - Kombi (Prefill + Generation) | 0,05 tok/s TG Prefill 20 · TTFT 267.436 ms | 10× | 2x NVIDIA GeForce RTX 20604x Intel(R) Xeon(R) CPU E5-4620 v2 @ 2.60GHz · 504 GB RAM | llama.cppgodclawQ4_K_M | Details → |
Agent & chat rating
Harness benchmark
Noch keine Harnessbenchmarks fuer dieses Modell.
