- Rang
- #140
- Gesamte Ausgabe-Token
- 302,730
- Antwortzeit (Durchschnitt)
- 97.68s
- Gesamtkosten
- $0.567
Qwen3.5 Plus 2026-02-15 (medium) vs GLM 5.3 Flash (high)
GLM 5.3 Flash (high) führt beim Durchschnittsscore mit 7.3 vs 7.2. GLM 5.3 Flash (high) hat die niedrigeren Benchmark-Kosten mit $0.084 vs $0.567. GLM 5.3 Flash (high) ist schneller mit 29.11s vs 97.68s, mit Erfolgsraten von 72.5% vs 66.7%.
Verglichene Modelle
- Rang
- #132
- Gesamte Ausgabe-Token
- 99,340
- Antwortzeit (Durchschnitt)
- 29.11s
- Gesamtkosten
- $0.084
Empfohlenes Modell
GLM 5.3 Flash (high)
Es hat hier die beste Punktzahl (7.3) und kostet etwa 6.8x weniger als Qwen3.5 Plus 2026-02-15 (medium).
Detaillierter Vergleich
| Metrik | Qwen3.5 Plus 2026-02-15 Qwen3.5 Plus 2026-02-15 medium | GLM 5.3 Flash GLM 5.3 Flash high |
|---|---|---|
| Punktzahl | 7.2 | 7.3 |
| Rang | #140 | #132 |
| Zuverlässigkeit | 10.0 | 10.0 |
| Konsistenz | 7.9 | 8.6 |
| Versuche | 69/69 | 69/69 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 72.5% | 66.7% |
| Instabile Tests | 6 | 4 |
| Gesamtläufe | 69 | 69 |
| Kosten pro Ergebnis | 4.047 | 0.426 |
| Gesamtkosten | $0.567 | $0.084 |
| Eingabepreis | $0.260 / 1M | $0.150 / 1M |
| Ausgabepreis | $1.560 / 1M | $0.500 / 1M |
| Gesamte Eingabe-Token | 249,486 | 225,013 |
| Ausgabe-Token | 14,481 | 12,197 |
| Denk-Token | 288,249 | 87,143 |
| Antwortzeit (Durchschnitt) | 97.68s | 29.11s |
| Antwortzeit (Maximum) | 304.85s | 163.41s |
| Antwortzeit (Gesamt) | 1562.81s | 669.54s |
| Parameter | ~397B insgesamt (~17B aktiv) | 320B insgesamt (18B aktiv) |
| Verfügbarkeit | Geschlossen | Open Source |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#140 Qwen3.5 Plus 2026-02-15
medium- Kosten
- $0.011
- Zeit
- 125.5s
- Token
- 7,040 tok
#132 GLM 5.3 Flash
high- Kosten
- $0.003
- Zeit
- 186.7s
- Token
- 10,486 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Agentenaufgaben | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.5 Plus 2026-02-15 | 6.1 | 3.1 | 66.7% | 1 | 186.40s | 135,917 | 4,658 | 23,363 | |
| GLM 5.3 Flash | 7.4 | 3.8 | 66.7% | 1 | 111.53s | 112,010 | 639 | 20,383 |
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.5 Plus 2026-02-15 | 8.2 | 7.9 | 83.3% | 1 | 45.78s | 672 | 205 | 21,236 | |
| GLM 5.3 Flash | 8.3 | 10.0 | 75.0% | 0 | 2.50s | 639 | 330 | 444 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.5 Plus 2026-02-15 | 6.6 | 7.1 | 44.4% | 1 | 180.70s | 6,950 | 420 | 80,595 | |
| GLM 5.3 Flash | 8.2 | 7.2 | 88.9% | 1 | 19.62s | 7,317 | 373 | 9,973 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.5 Plus 2026-02-15 | 6.9 | 5.9 | 66.7% | 1 | 175.85s | 87,576 | 8,085 | 69,183 | |
| GLM 5.3 Flash | 6.4 | 5.8 | 66.7% | 1 | 91.11s | 88,223 | 9,252 | 19,726 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.5 Plus 2026-02-15 | 10.0 | 10.0 | 100.0% | 0 | 46.91s | 7,782 | 270 | 14,916 | |
| GLM 5.3 Flash | 7.3 | 5.8 | 83.3% | 1 | 2.73s | 7,149 | 287 | 315 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.5 Plus 2026-02-15 | 5.3 | 7.2 | 44.4% | 1 | 55.99s | 453 | 35 | 30,685 | |
| GLM 5.3 Flash | 3.0 | 10.0 | 0.0% | 0 | 85.92s | 759 | 315 | 34,196 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.5 Plus 2026-02-15 | 4.7 | 1.6 | 66.7% | 1 | 79.86s | 344 | 73 | 8,675 | |
| GLM 5.3 Flash | 5.0 | 10.0 | 0.0% | 0 | 3.33s | 498 | 164 | 155 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.5 Plus 2026-02-15 | 10.0 | 10.0 | 100.0% | 0 | 31.93s | 699 | 101 | 7,704 | |
| GLM 5.3 Flash | 10.0 | 10.0 | 100.0% | 0 | 2.06s | 678 | 72 | 277 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.5 Plus 2026-02-15 | 10.0 | 10.0 | 100.0% | 0 | 32.50s | 696 | 301 | 13,853 | |
| GLM 5.3 Flash | 10.0 | 10.0 | 100.0% | 0 | 3.04s | 672 | 401 | 428 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.5 Plus 2026-02-15 | 10.0 | 10.0 | 100.0% | 0 | 7.54s | 8,193 | 309 | 909 | |
| GLM 5.3 Flash | 10.0 | 10.0 | 100.0% | 0 | 15.64s | 6,861 | 231 | 69 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Qwen3.5 Plus 2026-02-15 | 3.0 | 10.0 | 0.0% | 0 | 103.81s | 204 | 24 | 17,130 | |
| GLM 5.3 Flash | 3.0 | 10.0 | 0.0% | 0 | 11.52s | 207 | 133 | 1,177 |
Schnellvergleich
Vergleichspaar wechseln
Claude Fable 5.1mediumvsGLM 5.3 FlashhighGemini 3.8 FlashlowvsQwen3.5 Plus 2026-02-15mediumClaude Opus 4.8lowvsQwen3.5 Plus 2026-02-15mediumGemma 4 26B A4BmediumKostenlos verfügbarvsGLM 5.3 FlashhighGrok 4.7mediumvsGLM 5.3 FlashhighGemini 2.5 FlashmediumvsGLM 5.3 FlashhighQwen3.6 PlusmediumvsGLM 5.3 FlashhighInklingmediumKostenlos verfügbarvsGLM 5.3 FlashhighGemini 3.5 Flash LitemediumvsGLM 5.3 FlashhighDeepSeek V4 Pro 0423nonevsGLM 5.3 FlashhighLongCat 2.0highvsQwen3.5 Plus 2026-02-15mediumQwen3.5 Plus 2026-02-15mediumvsStep 3.7 Flashlow