- Rang
- #124
- Gesamte Ausgabe-Token
- 414,035
- Antwortzeit (Durchschnitt)
- 88.15s
- Gesamtkosten
- $0.307
DeepSeek V4 Flash 0731 (low) vs GLM 5.3 Flash (high)
DeepSeek V4 Flash 0731 (low) führt beim Durchschnittsscore mit 7.4 vs 7.3. GLM 5.3 Flash (high) hat die niedrigeren Benchmark-Kosten mit $0.084 vs $0.307. GLM 5.3 Flash (high) ist schneller mit 29.11s vs 88.15s, mit Erfolgsraten von 71.0% vs 66.7%.
Verglichene Modelle
- Rang
- #132
- Gesamte Ausgabe-Token
- 99,340
- Antwortzeit (Durchschnitt)
- 29.11s
- Gesamtkosten
- $0.084
Empfohlenes Modell
GLM 5.3 Flash (high)
Die Punktzahl bleibt nah an der besten hier (7.3 vs 7.4) und es kostet etwa 3.7x weniger als DeepSeek V4 Flash 0731 (low).
Detaillierter Vergleich
| Metrik | DeepSeek V4 Flash 0731 DeepSeek V4 Flash 0731 low | GLM 5.3 Flash GLM 5.3 Flash high |
|---|---|---|
| Punktzahl | 7.4 | 7.3 |
| Rang | #124 | #132 |
| Zuverlässigkeit | 10.0 | 10.0 |
| Konsistenz | 8.0 | 8.6 |
| Versuche | 69/69 | 69/69 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 71.0% | 66.7% |
| Instabile Tests | 6 | 4 |
| Gesamtläufe | 69 | 69 |
| Kosten pro Ergebnis | 0.840 | 0.426 |
| Gesamtkosten | $0.307 | $0.084 |
| Eingabepreis | $0.010 / 1M | $0.150 / 1M |
| Ausgabepreis | $1.280 / 1M | $0.500 / 1M |
| Gesamte Eingabe-Token | 231,356 | 225,013 |
| Ausgabe-Token | 43,054 | 12,197 |
| Denk-Token | 370,981 | 87,143 |
| Antwortzeit (Durchschnitt) | 88.15s | 29.11s |
| Antwortzeit (Maximum) | 438.65s | 163.41s |
| Antwortzeit (Gesamt) | 2027.36s | 669.54s |
| Parameter | 284B insgesamt (13B aktiv) | 320B insgesamt (18B aktiv) |
| Verfügbarkeit | Geschlossen | Open Source |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#124 DeepSeek V4 Flash 0731
low
No output was saved. The original provider response or failure reason is unavailable.
- Kosten
- $0.000
- Zeit
- 78.1s
- Token
- 8,090 tok
#132 GLM 5.3 Flash
high- Kosten
- $0.003
- Zeit
- 186.7s
- Token
- 10,486 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Agentenaufgaben | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 4.7 | 1.6 | 66.7% | 1 | 321.18s | 138,011 | 7,331 | 20,715 | |
| GLM 5.3 Flash | 7.4 | 3.8 | 66.7% | 1 | 111.53s | 112,010 | 639 | 20,383 |
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 8.2 | 7.9 | 83.3% | 1 | 10.08s | 540 | 1,833 | 6,605 | |
| GLM 5.3 Flash | 8.3 | 10.0 | 75.0% | 0 | 2.50s | 639 | 330 | 444 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 7.3 | 5.1 | 77.8% | 2 | 163.31s | 5,953 | 782 | 86,028 | |
| GLM 5.3 Flash | 8.2 | 7.2 | 88.9% | 1 | 19.62s | 7,317 | 373 | 9,973 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 9.8 | 10.0 | 100.0% | 0 | 54.25s | 68,913 | 8,230 | 22,729 | |
| GLM 5.3 Flash | 6.4 | 5.8 | 66.7% | 1 | 91.11s | 88,223 | 9,252 | 19,726 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 10.0 | 10.0 | 100.0% | 0 | 4.35s | 7,290 | 305 | 995 | |
| GLM 5.3 Flash | 7.3 | 5.8 | 83.3% | 1 | 2.73s | 7,149 | 287 | 315 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 3.0 | 10.0 | 0.0% | 0 | 255.51s | 657 | 20,100 | 171,883 | |
| GLM 5.3 Flash | 3.0 | 10.0 | 0.0% | 0 | 85.92s | 759 | 315 | 34,196 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 6.5 | 3.4 | 66.7% | 1 | 7.63s | 471 | 81 | 1,181 | |
| GLM 5.3 Flash | 5.0 | 10.0 | 0.0% | 0 | 3.33s | 498 | 164 | 155 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 9.9 | 10.0 | 100.0% | 0 | 3.01s | 627 | 94 | 644 | |
| GLM 5.3 Flash | 10.0 | 10.0 | 100.0% | 0 | 2.06s | 678 | 72 | 277 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 8.0 | 7.6 | 77.8% | 1 | 9.08s | 594 | 414 | 4,808 | |
| GLM 5.3 Flash | 10.0 | 10.0 | 100.0% | 0 | 3.04s | 672 | 401 | 428 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 10.0 | 10.0 | 100.0% | 0 | 4.44s | 8,178 | 367 | 186 | |
| GLM 5.3 Flash | 10.0 | 10.0 | 100.0% | 0 | 15.64s | 6,861 | 231 | 69 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 3.0 | 10.0 | 0.0% | 0 | 246.86s | 122 | 3,517 | 55,207 | |
| GLM 5.3 Flash | 3.0 | 10.0 | 0.0% | 0 | 11.52s | 207 | 133 | 1,177 |
Schnellvergleich
Vergleichspaar wechseln
DeepSeek V4 Flash 0731lowvsQwen3.6 FlashmediumDeepSeek V4 Flash 0731lowvsGPT-5.6 LunamediumSeed-2.0-CodemediumvsDeepSeek V4 Flash 0731lowDeepSeek V4 Flash 0731lowvsGLM 5.3 FlashXhighClaude Fable 5.1mediumvsGLM 5.3 FlashhighGemma 4 26B A4BmediumKostenlos verfügbarvsGLM 5.3 FlashhighDeepSeek V4 Flash 0731lowvsInkling SmallhighKostenlos verfügbarGrok 4.7mediumvsGLM 5.3 FlashhighGemini 2.5 FlashmediumvsGLM 5.3 FlashhighQwen3.6 PlusmediumvsGLM 5.3 FlashhighInklingmediumKostenlos verfügbarvsGLM 5.3 FlashhighGemini 3.5 Flash LitemediumvsGLM 5.3 Flashhigh