- Rang
- #124
- Gesamte Ausgabe-Token
- 414,035
- Antwortzeit (Durchschnitt)
- 88.15s
- Gesamtkosten
- $0.307
DeepSeek V4 Flash 0731 (low) vs GLM 5.1 (medium)
GLM 5.1 (medium) führt beim Durchschnittsscore mit 7.5 vs 7.4. DeepSeek V4 Flash 0731 (low) hat die niedrigeren Benchmark-Kosten mit $0.307 vs $1.066. GLM 5.1 (medium) ist schneller mit 66.38s vs 88.15s, mit Erfolgsraten von 71.0% vs 66.7%.
Verglichene Modelle
- Rang
- #119
- Gesamte Ausgabe-Token
- 248,708
- Antwortzeit (Durchschnitt)
- 66.38s
- Gesamtkosten
- $1.066
Empfohlenes Modell
DeepSeek V4 Flash 0731 (low)
Die Punktzahl bleibt nah an der besten hier (7.4 vs 7.5) und es kostet etwa 3.5x weniger als GLM 5.1 (medium).
Detaillierter Vergleich
| Metrik | DeepSeek V4 Flash 0731 DeepSeek V4 Flash 0731 low | GLM 5.1 GLM 5.1 medium |
|---|---|---|
| Punktzahl | 7.4 | 7.5 |
| Rang | #124 | #119 |
| Zuverlässigkeit | 10.0 | 9.2 |
| Konsistenz | 8.0 | 8.4 |
| Versuche | 69/69 | 69/69 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 71.0% | 66.7% |
| Instabile Tests | 6 | 4 |
| Gesamtläufe | 69 | 69 |
| Kosten pro Ergebnis | 0.840 | 9.004 |
| Gesamtkosten | $0.307 | $1.066 |
| Eingabepreis | $0.010 / 1M | $0.965 / 1M |
| Ausgabepreis | $1.280 / 1M | $3.032 / 1M |
| Gesamte Eingabe-Token | 231,356 | 331,577 |
| Ausgabe-Token | 43,054 | 17,919 |
| Denk-Token | 370,981 | 230,789 |
| Antwortzeit (Durchschnitt) | 88.15s | 66.38s |
| Antwortzeit (Maximum) | 438.65s | 308.75s |
| Antwortzeit (Gesamt) | 2027.36s | 1460.31s |
| Parameter | 284B insgesamt (13B aktiv) | 744B insgesamt (40B aktiv) |
| Verfügbarkeit | Geschlossen | Open Source |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#124 DeepSeek V4 Flash 0731
low
No output was saved. The original provider response or failure reason is unavailable.
- Kosten
- $0.000
- Zeit
- 78.1s
- Token
- 8,090 tok
#119 GLM 5.1
medium
Reached the allocated time limit (300 seconds) without receiving showcase output.
- Kosten
- $0.000
- Zeit
- 300.0s
- Token
- 0 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Agentenaufgaben | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 4.7 | 1.6 | 66.7% | 1 | 321.18s | 138,011 | 7,331 | 20,715 | |
| GLM 5.1 | 10.0 | 10.0 | 100.0% | 0 | 225.59s | 248,985 | 1,830 | 30,989 |
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 8.2 | 7.9 | 83.3% | 1 | 10.08s | 540 | 1,833 | 6,605 | |
| GLM 5.1 | 10.0 | 10.0 | 100.0% | 0 | 8.31s | 555 | 401 | 5,122 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 7.3 | 5.1 | 77.8% | 2 | 163.31s | 5,953 | 782 | 86,028 | |
| GLM 5.1 | 4.6 | 3.7 | 44.5% | 2 | 109.63s | 5,702 | 4,871 | 37,826 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 9.8 | 10.0 | 100.0% | 0 | 54.25s | 68,913 | 8,230 | 22,729 | |
| GLM 5.1 | 9.8 | 10.0 | 100.0% | 0 | 175.93s | 66,926 | 4,761 | 65,248 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 10.0 | 10.0 | 100.0% | 0 | 4.35s | 7,290 | 305 | 995 | |
| GLM 5.1 | 10.0 | 10.0 | 100.0% | 0 | 9.33s | 7,107 | 991 | 4,552 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 3.0 | 10.0 | 0.0% | 0 | 255.51s | 657 | 20,100 | 171,883 | |
| GLM 5.1 | 3.0 | 10.0 | 0.0% | 0 | 113.95s | 458 | 969 | 74,651 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 6.5 | 3.4 | 66.7% | 1 | 7.63s | 471 | 81 | 1,181 | |
| GLM 5.1 | 10.0 | 10.0 | 100.0% | 0 | 20.95s | 477 | 2,875 | 2,875 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 9.9 | 10.0 | 100.0% | 0 | 3.01s | 627 | 94 | 644 | |
| GLM 5.1 | 6.4 | 5.8 | 66.7% | 1 | 7.47s | 634 | 204 | 1,617 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 8.0 | 7.6 | 77.8% | 1 | 9.08s | 594 | 414 | 4,808 | |
| GLM 5.1 | 8.2 | 7.2 | 88.9% | 1 | 31.64s | 609 | 935 | 5,730 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 10.0 | 10.0 | 100.0% | 0 | 4.44s | 8,178 | 367 | 186 | |
| GLM 5.1 | 3.0 | 10.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4 Flash 0731 | 3.0 | 10.0 | 0.0% | 0 | 246.86s | 122 | 3,517 | 55,207 | |
| GLM 5.1 | 3.0 | 10.0 | 0.0% | 0 | 29.40s | 124 | 82 | 2,179 |
Schnellvergleich
Vergleichspaar wechseln
Space Bunny AlphahighvsGLM 5.1mediumDeepSeek V4 Flash 0731lowvsQwen3.6 FlashmediumDeepSeek V4 Flash 0731lowvsGPT-5.6 LunamediumSeed-2.0-CodemediumvsDeepSeek V4 Flash 0731lowDeepSeek V4 Flash 0731lowvsGLM 5.3 FlashXhighDeepSeek V4 Flash 0731lowvsInkling SmallhighKostenlos verfügbarQwen3.8 27BlowKostenlos verfügbarvsGLM 5.1mediumGPT-6 LunalowvsGLM 5.1mediumDeepSeek V4 Flash 0731lowvsInklingmediumKostenlos verfügbarSeed-2.0-CodehighvsDeepSeek V4 Flash 0731lowSeed-2.0-CodehighvsGLM 5.1mediumDeepSeek V4 Flash 0731lowvsGemma 4 26B A4BmediumKostenlos verfügbar