Q
Hersteller
Qwen (Alibaba)
Qwen-Modellfamilie von Alibaba.
Beste Token-Generierung
97,6 tok/s
Qwen3-30B-A3B-Instruct-2507
Bester Prefill
8.376,7 tok/s
Qwen3-Coder-30B-A3B-Instruct
∅ Token-Generierung
47,6 tok/s
Schnitt aus 68 Laeufen
∅ Prefill
3.630,1 tok/s
Schnitt aus 68 Laeufen
Bester TTFT
122 ms
Qwen3.6-27B
Beste Harness-Quote
41%
Qwen3.6-27B
🏆
Qwen3-30B-A3B-Instruct-2507 · schnellstes Modell mit 97,6 tok/s Token-Generierung
Bester Prefill des Herstellers: 8.376,7 tok/s (Qwen3-Coder-30B-A3B-Instruct)
Bester Prefill des Herstellers: 8.376,7 tok/s (Qwen3-Coder-30B-A3B-Instruct)
Top-Modelle nach Token-Generierung
Bester gemessener Generierungs-Durchsatz je Modell (tok/s), veroeffentlichte Performancebenchmarks.
Modelle
Alle Benchmarks →13 zugeordnet
Qwen (Alibaba)
Qwen-AgentWorld-35B-A3B
MoE · 35B
TG 78,5 tok/s
Prefill 2.873,3 tok/s
3 Benchmarks →
Qwen (Alibaba)
Qwen2.5-32B-Instruct-AWQ
Dense · 32B
TG –
Prefill –
2 Benchmarks →
Qwen (Alibaba)
Qwen2.5-72B-Instruct-Q4_K_M.gguf
Dense · 72B
TG 2,3 tok/s
Prefill 80,8 tok/s
1 Benchmarks →
Qwen (Alibaba)
Qwen2.5-Coder-32B-Instruct
Dense · 32B
TG 21,2 tok/s
Prefill 8.243,6 tok/s
12 Benchmarks →
Qwen (Alibaba)
Qwen3-30B-A3B-Instruct-2507
MoE · 30B
TG 97,6 tok/s
Prefill 5.443,1 tok/s
9 Benchmarks →
Qwen (Alibaba)
Qwen3-30B-A3B-Thinking-2507
MoE · 30B
TG 91,4 tok/s
Prefill 8.044,0 tok/s
8 Benchmarks →
Qwen (Alibaba)
Qwen3-Coder-30B-A3B-Instruct
MoE · 30B
TG 88,2 tok/s
Prefill 8.376,7 tok/s
9 Benchmarks →
Qwen (Alibaba)
Qwen3-Coder-Next
MoE
TG 62,4 tok/s
Prefill 2.409,6 tok/s
4 Benchmarks →
Qwen (Alibaba)
Qwen3-Omni-30B-A3B-Thinking
MoE · 30B
TG 34,8 tok/s
Prefill 5.527,5 tok/s
1 Benchmarks →
Qwen (Alibaba)
Qwen3-VL-30B-A3B-Instruct
MoE · 30B
TG 89,8 tok/s
Prefill 7.938,6 tok/s
7 Benchmarks →
Qwen (Alibaba)
Qwen3.5-35B-A3B
MoE · 35B
TG 78,5 tok/s
Prefill 4.997,9 tok/s
7 Benchmarks →
Qwen (Alibaba)
Qwen3.6-27B
Dense · 27B
TG 28,8 tok/s
Prefill 599,4 tok/s
3 Benchmarks →
Qwen (Alibaba)
Qwen3.6-35B-A3B
MoE · 35B
TG 79,4 tok/s
Prefill 5.971,1 tok/s
6 Benchmarks →
