- Rang
- #74
- Gesamte Ausgabe-Token
- 532,511
- Antwortzeit (Durchschnitt)
- 118.83s
- Gesamtkosten
- $0.578
DeepSeek V4 Flash 0731 (high) vs GLM 5.2 (medium)
DeepSeek V4 Flash 0731 (high) führt beim Durchschnittsscore mit 8.4 vs 8.2. GLM 5.2 (medium) hat die niedrigeren Benchmark-Kosten mit $0.398 vs $0.578. GLM 5.2 (medium) ist schneller mit 26.88s vs 118.83s, mit Erfolgsraten von 76.8% vs 81.2%.
Verglichene Modelle
- Rang
- #83
- Gesamte Ausgabe-Token
- 81,020
- Antwortzeit (Durchschnitt)
- 26.88s
- Gesamtkosten
- $0.398
Empfohlenes Modell
GLM 5.2 (medium)
Die Punktzahl bleibt nah an der besten hier (8.2 vs 8.4) und es antwortet etwa 4.4x schneller als DeepSeek V4 Flash 0731 (high).
Detaillierter Vergleich
| Metrik | DeepSeek V4 Flash 0731 DeepSeek V4 Flash 0731 high | GLM 5.2 GLM 5.2 medium |
|---|---|---|
| Punktzahl | 8.4 | 8.2 |
| Rang | #74 | #83 |
| Zuverlässigkeit | 10.0 | 9.6 |
| Konsistenz | 8.1 | 8.1 |
| Versuche | 69/69 | 66/69 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 76.8% | 81.2% |
| Instabile Tests | 5 | 4 |
| Gesamtläufe | 69 | 66 |
| Kosten pro Ergebnis | 1.069 | 2.890 |
| Gesamtkosten | $0.578 | $0.398 |
| Eingabepreis | $0.010 / 1M | $0.325 / 1M |
| Ausgabepreis | $1.280 / 1M | $3.990 / 1M |
| Gesamte Eingabe-Token | 281,863 | 227,164 |
| Ausgabe-Token | 24,535 | 20,029 |
| Denk-Token | 507,976 | 60,991 |
| Antwortzeit (Durchschnitt) | 118.83s | 26.88s |
| Antwortzeit (Maximum) | 600.61s | 102.40s |
| Antwortzeit (Gesamt) | 2733.01s | 591.34s |
| Parameter | 284B insgesamt (13B aktiv) | 744B insgesamt (40B aktiv) |
| Verfügbarkeit | Geschlossen | Open Source |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#74 DeepSeek V4 Flash 0731
high
No output was saved. The original provider response or failure reason is unavailable.
- Kosten
- $0.000
- Zeit
- 187.3s
- Token
- 19,048 tok
#83 GLM 5.2
medium- Kosten
- $0.041
- Zeit
- 195.8s
- Token
- 9,287 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Agentenaufgaben | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 10.0 | 10.0 | 100.0% | 0 | 204.36s | 185,161 | 7,569 | 11,635 | |
| GLM 5.2 | 10.0 | 10.0 | 100.0% | 0 | 102.40s | 189,965 | 7,768 | 11,491 |
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 8.7 | 7.9 | 91.7% | 1 | 13.62s | 1,488 | 542 | 10,576 | |
| GLM 5.2 | 10.0 | 10.0 | 100.0% | 0 | 5.89s | 639 | 497 | 2,634 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 6.3 | 6.3 | 55.6% | 1 | 252.67s | 7,044 | 2,160 | 191,210 | |
| GLM 5.2 | 8.2 | 7.2 | 88.9% | 1 | 40.96s | 7,317 | 1,475 | 17,123 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 10.0 | 10.0 | 100.0% | 0 | 87.10s | 67,283 | 11,903 | 41,397 | |
| GLM 5.2 | 5.0 | 5.0 | 50.0% | 0 | 51.96s | 12,696 | 458 | 4,531 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 10.0 | 10.0 | 100.0% | 0 | 3.65s | 7,764 | 336 | 1,259 | |
| GLM 5.2 | 10.0 | 10.0 | 100.0% | 0 | 13.44s | 7,149 | 348 | 2,345 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 3.5 | 4.4 | 33.3% | 2 | 458.65s | 700 | 104 | 215,629 | |
| GLM 5.2 | 4.1 | 4.4 | 44.5% | 2 | 45.47s | 551 | 8,188 | 11,606 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 10.0 | 10.0 | 100.0% | 0 | 5.64s | 708 | 72 | 533 | |
| GLM 5.2 | 10.0 | 10.0 | 100.0% | 0 | 17.39s | 498 | 54 | 1,842 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 9.8 | 10.0 | 100.0% | 0 | 4.46s | 1,101 | 119 | 939 | |
| GLM 5.2 | 9.9 | 10.0 | 100.0% | 0 | 7.90s | 678 | 94 | 1,518 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 8.2 | 7.7 | 77.8% | 1 | 9.36s | 1,305 | 397 | 6,801 | |
| GLM 5.2 | 8.2 | 7.2 | 88.9% | 1 | 13.13s | 672 | 536 | 4,822 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 10.0 | 10.0 | 100.0% | 0 | 5.42s | 8,889 | 357 | 451 | |
| GLM 5.2 | 10.0 | 10.0 | 100.0% | 0 | 20.41s | 6,861 | 230 | 550 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 3.0 | 10.0 | 0.0% | 0 | 110.63s | 420 | 976 | 27,546 | |
| GLM 5.2 | 3.0 | 10.0 | 0.0% | 0 | 34.25s | 138 | 381 | 2,529 |
Schnellvergleich
Vergleichspaar wechseln
Grok 4.5highvsGLM 5.2mediumDeepSeek V4 Flash 0731highvsGemini 3.1 Pro PreviewmediumDeepSeek V4 Flash 0731highvsMuse Glimmer 30BxhighDeepSeek V4 Flash 0731highvsGPT-5 MinimediumDeepSeek V4 Flash 0731highvsQwen3.8 2.4T A95BlowKimi K3maxvsGLM 5.2mediumGemini 3.5 FlashhighvsGLM 5.2mediumDeepSeek V4 Flash 0731highvsKimi K3maxGPT-5.6 TerrahighvsGLM 5.2mediumSeed-2.0-CodelowvsGLM 5.2mediumDeepSeek V4 Flash 0731highvsGPT-6 LunamediumClaude Opus 4.8mediumvsDeepSeek V4 Flash 0731high