Created bymario-alka.dePowered bygodcore.denoob2claw.detricoma.de
🌐
🧮
Mainboard

Dell Inc. PowerEdge R820

Dell1 CPU36 Benchmarks
CPUs
1
Modelle
17
Benchmarks
36
Beste Generation
14,5 tok/s
🏆
gpt-oss-20b läuft am schnellsten auf diesem Board · 14,5 tok/s
17 Modelle mit Performance-Daten getestet

Top-Modelle nach Token-Generierung

Bester gemessener Generierungs-Durchsatz je Modell auf Dell Inc. PowerEdge R820 (tok/s) – klicken für Leaderboard-Filter.

gpt-oss-20b
14,5 tok/s
gpt-oss-120b
5,3 tok/s
MiniMax-M2.7
2,6 tok/s
Modell-Vergleich

Getestete Modelle im Vergleich

Jede Blase ist ein Modell auf Dell Inc. PowerEdge R820 – Position: Prompt-Verarbeitung (X) × Ausgabe-Geschwindigkeit (Y), Blasengröße: Anzahl Messläufe. Naeher an der oberen rechten Ecke = schneller.

MODnach Modell

18,614,09,34,70,004284126Prefill (tok/s)Generation (tok/s)gpt-oss-20b - 14,5 tok/s Generation, 88 tok/s Prefill, TTFT 122.346 ms (3 Laufe)gpt-oss-20bQwen3-30B-A3B-Thinking-2507 - 8,5 tok/s Generation, 74 tok/s Prefill, TTFT 134.321 ms (3 Laufe)Qwen3-30B-A3B-Thinkin...NVIDIA-Nemotron-3-Nano-4B - 8,0 tok/s Generation, 63 tok/s Prefill, TTFT 139.289 ms (3 Laufe)NVIDIA-Nemotron-3-Nan...Qwen3-30B-A3B-Instruct-2507 - 7,1 tok/s Generation, 102 tok/s Prefill, TTFT 109.338 ms (3 Laufe)Qwen3-30B-A3B-Instruc...Qwen3-Coder-30B-A3B-Instruct - 6,7 tok/s Generation, 103 tok/s Prefill, TTFT 107.342 ms (3 Laufe)Qwen3-Coder-30B-A3B-I...Nemotron-Cascade-2-30B-A3B - 5,9 tok/s Generation, 72 tok/s Prefill, TTFT 130.288 ms (3 Laufe)Nemotron-Cascade-2-30...gpt-oss-120b - 5,3 tok/s Generation, 42 tok/s Prefill, TTFT 165.568 ms (3 Laufe)gpt-oss-120bNorth-Mini-Code-1.0 - 5,1 tok/s Generation, 89 tok/s Prefill, TTFT 113.797 ms (3 Laufe)North-Mini-Code-1.0Qwen3.6-35B-A3B - 4,3 tok/s Generation, 62 tok/s Prefill, TTFT 31.435 ms (1 Lauf)Qwen3.6-35B-A3BMeta-Llama-3.1-8B-Instruct - 3,6 tok/s Generation, 36 tok/s Prefill, TTFT 59.044 ms (1 Lauf)Meta-Llama-3.1-8B-Ins...MiniMax-M2.7 - 2,6 tok/s Generation, 24 tok/s Prefill, TTFT 193.311 ms (3 Laufe)MiniMax-M2.7Qwen2.5-72B-Instruct-Q4_K_M.gguf - 2,3 tok/s Generation, 81 tok/s Prefill, TTFT 569 ms (1 Lauf)Qwen2.5-72B-Instruct-...GLM-4.5-Air - 2,1 tok/s Generation, 18 tok/s Prefill, TTFT 117.963 ms (1 Lauf)GLM-4.5-AirDeepSeek-V4-Flash-284B-A13B - 1,2 tok/s Generation, 14 tok/s Prefill, TTFT 148.315 ms (1 Lauf)DeepSeek-V4-Flash-284...OpenReasoning-Nemotron-32B - 1,1 tok/s Generation, 8 tok/s Prefill, TTFT 266.668 ms (1 Lauf)OpenReasoning-Nemotro...Seed-OSS-36B-Instruct - 1,0 tok/s Generation, 8 tok/s Prefill, TTFT 240.790 ms (1 Lauf)Seed-OSS-36B-InstructMiniMax-M2.5 - 0,8 tok/s Generation, 22 tok/s Prefill, TTFT 98.716 ms (1 Lauf)MiniMax-M2.5
gpt-oss-20b 14,5 tok/sQwen3-30B-A3B-Thinking-2507 8,5 tok/sNVIDIA-Nemotron-3-Nano-4B 8,0 tok/sQwen3-30B-A3B-Instruct-2507 7,1 tok/sQwen3-Coder-30B-A3B-Instruct 6,7 tok/sNemotron-Cascade-2-30B-A3B 5,9 tok/sgpt-oss-120b 5,3 tok/sNorth-Mini-Code-1.0 5,1 tok/sQwen3.6-35B-A3B 4,3 tok/sMeta-Llama-3.1-8B-Instruct 3,6 tok/sMiniMax-M2.7 2,6 tok/sQwen2.5-72B-Instruct-Q4_K_M.gguf 2,3 tok/sGLM-4.5-Air 2,1 tok/sDeepSeek-V4-Flash-284B-A13B 1,2 tok/sOpenReasoning-Nemotron-32B 1,1 tok/sSeed-OSS-36B-Instruct 1,0 tok/sMiniMax-M2.5 0,8 tok/s

Grafikkarten auf diesem Board

Keine GPU (CPU-only).

Getestete Modelle

Genutzte Betriebssysteme

← Alle Hardware