🎮
Grafikkarte
AMD Radeon Graphics
AMD
Beste Generation
42,2 tok/s
Gemma-4-26B-A4B-it
∅ Generation
25,6 tok/s
Schnitt aus 2 Läufen
Bester Prefill
71 tok/s
Prompt-Verarbeitung
Bester TTFT
609 ms
Time to First Token
Beste Harness-Quote
13%
1 Harness-Läufe
🏆
Gemma-4-26B-A4B-it läuft am schnellsten auf dieser GPU · 42,2 tok/s
Bester Prefill: 71 tok/s · 2 Modelle getestet
Bester Prefill: 71 tok/s · 2 Modelle getestet
Top-Modelle nach Token-Generierung
Bester gemessener Generierungs-Durchsatz je Modell auf AMD Radeon Graphics (tok/s).
Performanceprofil
Durchsatz auf AMD Radeon Graphics
Jede Blase steht für ein Modell, eine Engine bzw. eine CPU – Position: Prompt-Verarbeitung (X) × Ausgabe (Y), Blasengröße: Anzahl Messläufe.
MODnach Modell
Gemma-4-26B-A4B-it 42,2 tok/sDevstral-Small-2-24B-Instruct-2512 8,9 tok/s
ENGnach Engine
llama.cpp 42,2 tok/s
CPUnach Prozessor
AMD RYZEN AI MAX+ 395 w/ Radeon 8060S 42,2 tok/s
Alle Messungen
Im Leaderboard →3 Benchmark-Läufe
Jeder veroeffentlichte Lauf auf AMD Radeon Graphics – Performance und Harness.
| # | Modell / Hersteller | Typ | Messwerte | GPU / CPU / RAM | Runtime | Datum | ||
|---|---|---|---|---|---|---|---|---|
| 1 | Gemma-4-26B-A4B-itGooglePerformancetest Small 1.0 | Performancebenchmark | 42,22 tok/s Prefill 71 · TTFT 609 ms | AMD Radeon Graphics32x AMD RYZEN AI MAX+ 395 w/ Radeon 8060S · 31 GB RAM | llama.cppgodclaw Q8_0 | 22.07.2026 | Details → | |
| 2 | Qwen2.5-32B-Instruct-AWQQwen (Alibaba)Tool Usage V 1.0 | Harnessbenchmark | 13,4 % 235/1.760 Pkt · 15/15 Aufg. | AMD Radeon Graphics32x AMD RYZEN AI MAX+ 395 w/ Radeon 8060S · 31 GB RAM | openclaw_cli | 04.04.2026 | Details → | |
| 3 | Devstral-Small-2-24B-Instruct-2512Mistral AIPerformancetest Small 1.0 | Performancebenchmark | 8,88 tok/s Prefill 22 · TTFT 906 ms | AMD Radeon Graphics32x AMD RYZEN AI MAX+ 395 w/ Radeon 8060S · 31 GB RAM | llama.cppgodclaw Q8_0 | 20.07.2026 | Details → |
