Z.ai (Zhipu)
glm-4.7-flash
Benchmarkprofil und veröffentlichte Ergebnisse.
Einordnung im Feld
Bestwerte im Vergleich
Beste Messwerte dieses Modells gegen Minimum, Durchschnitt und Maximum aller veröffentlichten Systeme.
Generation48,9 tok/s
Min 0,0Ø 245,9Max 2.491,2
Unter dem Durchschnitt · 4037 Systeme im Feld
Prefill4.055 tok/s
Min 4Ø 4.711Max 55.260
Unter dem Durchschnitt · 4037 Systeme im Feld
Time to First Token536 ms
Min 20Ø 34.263Max 535.235
Ueber dem Durchschnitt · 4035 Systeme im Feld
Performanceprofil
Durchsatz nach Hardware & Engine
Jede Blase steht für eine GPU, CPU bzw. Engine – die Position zeigt Prompt-Verarbeitung (X) und Ausgabe-Geschwindigkeit (Y), die Blasengröße die Anzahl der Messläufe.
Durchsatz & Latenz
Performancebenchmark
| # | Modell / Hersteller | Messwerte | Parallel | GPU / CPU / RAM | Runtime | ||
|---|---|---|---|---|---|---|---|
| 1 | glm-4.7-flashZ.ai (Zhipu) PerformancebenchmarkTimebench 3 - Kombi (Prefill + Generation) | 48,92 tok/s TG Prefill 4.055 · TTFT 536 ms | 1× | NVIDIA GB10 (DGX Spark)NVIDIA Grace · 120 GB RAM | vLLMgodclawAWQ | Details → |
Agent- & Chat-Bewertung
Harnessbenchmark
Noch keine Harnessbenchmarks fuer dieses Modell.
