Meta
Meta-Llama-3.1-8B-Instruct
Benchmarkprofil und veroeffentlichte Ergebnisse.
Dense8B
Einordnung im Feld
Bestwerte im Vergleich
Beste Messwerte dieses Modells gegen Minimum, Durchschnitt und Maximum aller veroeffentlichten Systeme.
Generation83,4 tok/s
Min 0,0Ø 100,2Max 1.443,9
Unter dem Durchschnitt · 346 Systeme im Feld
Prefill2.658 tok/s
Min 6Ø 3.397Max 37.116
Unter dem Durchschnitt · 345 Systeme im Feld
Time to First Token1.773 ms
Min 91Ø 21.178Max 299.591
Ueber dem Durchschnitt · 347 Systeme im Feld
Performanceprofil
Durchsatz nach Hardware & Engine
Jede Blase steht für eine GPU, CPU bzw. Engine – die Position zeigt Prompt-Verarbeitung (X) und Ausgabe-Geschwindigkeit (Y), die Blasengröße die Anzahl der Messläufe.
GPUnach Grafikkarte
AMD Radeon 8060S Graphics 83,4 tok/sCPU-only 3,6 tok/s
CPUnach Prozessor
AMD RYZEN AI MAX+ 395 w/ Radeon 8060S 83,4 tok/sIntel(R) Xeon(R) CPU E5-4620 v2 @ 2.60GHz 3,6 tok/s
ENGnach Engine
llama.cpp 83,4 tok/s
Agent- & Chat-Bewertung
Harnessbenchmark
Noch keine Harnessbenchmarks fuer dieses Modell.
Durchsatz & Latenz
Performancebenchmark
| # | Modell / Hersteller | Messwerte | Parallel | GPU / CPU / RAM | Runtime | ||
|---|---|---|---|---|---|---|---|
| 1 | Meta-Llama-3.1-8B-InstructMeta PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 83,37 tok/s TG Prefill 2.658 · TTFT 10.905 ms | 10× | AMD Radeon 8060S Graphics32x AMD RYZEN AI MAX+ 395 w/ Radeon 8060S · 31 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 2 | Meta-Llama-3.1-8B-InstructMeta PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 76,24 tok/s TG Prefill 1.951 · TTFT 6.429 ms | 5× | AMD Radeon 8060S Graphics32x AMD RYZEN AI MAX+ 395 w/ Radeon 8060S · 31 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 3 | Meta-Llama-3.1-8B-InstructMeta PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 40,39 tok/s TG Prefill 1.237 · TTFT 1.773 ms | 1× | AMD Radeon 8060S Graphics32x AMD RYZEN AI MAX+ 395 w/ Radeon 8060S · 31 GB RAM | llama.cppgodclawQ4_K_M | Details → | |
| 4 | Meta-Llama-3.1-8B-InstructMeta PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 3,55 tok/s TG Prefill 36 · TTFT 59.044 ms | 1× | Keine GPU (CPU-only)51x Intel(R) Xeon(R) CPU E5-4620 v2 @ 2.60GHz · 504 GB RAM | llama.cppgodclawQ4_K_M | Details → |
