- Rang
- #71
- Gesamte Ausgabe-Token
- 102,691
- Antwortzeit (Durchschnitt)
- 22.71s
- Gesamtkosten
- $1.585
Gemini 3.1 Pro Preview (medium) vs Qwen3.7 Max (medium)
Qwen3.7 Max (medium) führt beim Durchschnittsscore mit 8.5 vs 8.4. Gemini 3.1 Pro Preview (medium) hat die niedrigeren Benchmark-Kosten mit $1.585 vs $1.689. Gemini 3.1 Pro Preview (medium) ist schneller mit 22.71s vs 48.35s, mit Erfolgsraten von 89.9% vs 85.5%.
Verglichene Modelle
- Rang
- #67
- Gesamte Ausgabe-Token
- 259,032
- Antwortzeit (Durchschnitt)
- 48.35s
- Gesamtkosten
- $1.689
Empfohlenes Modell
Gemini 3.1 Pro Preview (medium)
Die Punktzahl bleibt nah an der besten hier (8.4 vs 8.5) und es antwortet etwa 2.1x schneller als Qwen3.7 Max (medium).
Detaillierter Vergleich
| Metrik | Gemini 3.1 Pro Preview Gemini 3.1 Pro Preview medium | Qwen3.7 Max Qwen3.7 Max medium |
|---|---|---|
| Punktzahl | 8.4 | 8.5 |
| Rang | #71 | #67 |
| Zuverlässigkeit | 9.8 | 10.0 |
| Konsistenz | 9.6 | 8.7 |
| Versuche | 69/69 | 69/69 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 89.9% | 85.5% |
| Instabile Tests | 1 | 4 |
| Gesamtläufe | 69 | 69 |
| Kosten pro Ergebnis | 7.924 | 12.033 |
| Gesamtkosten | $1.585 | $1.689 |
| Eingabepreis | $2.000 / 1M | $1.475 / 1M |
| Ausgabepreis | $12.000 / 1M | $4.425 / 1M |
| Preis für Cache-Lesen | $0.200 / 1M | $0.295 / 1M |
| Preis für Cache-Schreiben | $0.375 / 1M | $1.844 / 1M |
| Gesamte Eingabe-Token | 176,208 | 367,848 |
| Ausgabe-Token | 6,093 | 8,753 |
| Denk-Token | 96,598 | 250,279 |
| Antwortzeit (Durchschnitt) | 22.71s | 48.35s |
| Antwortzeit (Maximum) | 88.68s | 556.06s |
| Antwortzeit (Gesamt) | 386.11s | 1112.11s |
| Parameter | ~1.2T insgesamt (~20B aktiv) | ~1T insgesamt (~40B aktiv) |
| Verfügbarkeit | Geschlossen | Geschlossen |
Cache-Preise gelten für Eingabetokens. Lesen nutzt gespeicherte Prompts erneut; Schreiben speichert sie und kann mehr kosten. Für Ausgabetokens gilt der Ausgabepreis.
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#71 Gemini 3.1 Pro Preview
medium- Kosten
- $0.115
- Zeit
- 87.2s
- Token
- 9,629 tok
#67 Qwen3.7 Max
medium- Kosten
- $0.017
- Zeit
- 68.8s
- Token
- 4,526 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Agentenaufgaben | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Pro Preview | 4.7 | 1.6 | 66.7% | 1 | 56.17s | 83,912 | 861 | 4,592 | |
| Qwen3.7 Max | 6.1 | 3.1 | 66.7% | 1 | 137.00s | 261,819 | 3,005 | 29,925 |
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 7.90s | 498 | 112 | 3,218 | |
| Qwen3.7 Max | 10.0 | 10.0 | 100.0% | 0 | 6.36s | 672 | 222 | 8,742 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Pro Preview | 7.9 | 9.9 | 66.7% | 0 | 40.17s | 8,124 | 435 | 41,247 | |
| Qwen3.7 Max | 10.0 | 10.0 | 100.0% | 0 | 35.31s | 7,893 | 423 | 34,808 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Pro Preview | 9.8 | 10.0 | 100.0% | 0 | 40.39s | 67,910 | 3,687 | 23,111 | |
| Qwen3.7 Max | 8.7 | 6.9 | 83.3% | 1 | 287.83s | 78,594 | 3,985 | 96,450 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 7.72s | 7,265 | 279 | 3,904 | |
| Qwen3.7 Max | 10.0 | 10.0 | 100.0% | 0 | 8.80s | 7,782 | 270 | 6,254 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Pro Preview | 7.7 | 10.0 | 66.7% | 0 | 20.29s | 644 | 18 | 11,704 | |
| Qwen3.7 Max | 4.1 | 4.4 | 44.5% | 2 | 52.45s | 780 | 61 | 41,143 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 11.77s | 490 | 108 | 1,179 | |
| Qwen3.7 Max | 10.0 | 10.0 | 100.0% | 0 | 11.70s | 516 | 135 | 4,457 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 9.56s | 621 | 72 | 2,236 | |
| Qwen3.7 Max | 10.0 | 10.0 | 100.0% | 0 | 7.46s | 699 | 102 | 5,452 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 6.90s | 570 | 235 | 3,128 | |
| Qwen3.7 Max | 10.0 | 10.0 | 100.0% | 0 | 8.84s | 696 | 259 | 8,908 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 23.15s | 6,018 | 274 | 982 | |
| Qwen3.7 Max | 10.0 | 10.0 | 100.0% | 0 | 6.63s | 8,193 | 267 | 1,220 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 6.27s | 156 | 12 | 1,297 | |
| Qwen3.7 Max | 3.0 | 10.0 | 0.0% | 0 | 33.37s | 204 | 24 | 12,920 |
Schnellvergleich
Vergleichspaar wechseln
Muse Spark 1.3lowvsQwen3.7 MaxmediumGemini 3.1 Pro PreviewmediumvsInklinghighKostenlos verfügbarGemini 3.1 Pro PreviewmediumvsMuse Glimmer 30BxhighGemini 3.1 Pro PreviewmediumvsMuse Spark 1.1highGemini 3.1 Pro PreviewmediumvsQwen3.8 2.4T A95BlowQwen3.7 MaxmediumvsGrok 4.6highDeepSeek V4 Flash 0731highvsGemini 3.1 Pro PreviewmediumGemini 3.1 Pro PreviewmediumvsGLM 5.2highMuse Glimmer 30BxhighvsQwen3.7 MaxmediumClaude Sonnet 5.5highvsQwen3.7 MaxmediumGemini 3.1 Pro PreviewmediumvsGPT-5.6 TerrahighClaude Sonnet 5.5xhighvsQwen3.7 Maxmedium