- Rang
- #101
- Gesamte Ausgabe-Token
- 96,655
- Antwortzeit (Durchschnitt)
- 11.78s
- Gesamtkosten
- $1.316
Gemini 3.5 Flash (medium) vs Qwen3.7 Plus
Gemini 3.5 Flash (medium) führt beim Durchschnittsscore mit 7.9 vs 7.8. Qwen3.7 Plus hat die niedrigeren Benchmark-Kosten mit $0.184 vs $1.316. Gemini 3.5 Flash (medium) ist schneller mit 11.78s vs 17.80s, mit Erfolgsraten von 81.2% vs 56.5%.
Verglichene Modelle
- Rang
- #108
- Gesamte Ausgabe-Token
- 76,261
- Antwortzeit (Durchschnitt)
- 17.80s
- Gesamtkosten
- $0.184
Empfohlenes Modell
Qwen3.7 Plus
Die Punktzahl bleibt nah an der besten hier (7.8 vs 7.9) und es kostet etwa 7.2x weniger als Gemini 3.5 Flash (medium).
Detaillierter Vergleich
| Metrik | Gemini 3.5 Flash Gemini 3.5 Flash medium | Qwen3.7 Plus Qwen3.7 Plus none |
|---|---|---|
| Punktzahl | 7.9 | 7.8 |
| Rang | #101 | #108 |
| Zuverlässigkeit | 10.0 | 10.0 |
| Konsistenz | 9.3 | 10.0 |
| Versuche | 69/69 | 69/69 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 81.2% | 56.5% |
| Instabile Tests | 2 | 0 |
| Gesamtläufe | 69 | 69 |
| Kosten pro Ergebnis | 7.306 | 1.410 |
| Gesamtkosten | $1.316 | $0.184 |
| Eingabepreis | $1.500 / 1M | $0.320 / 1M |
| Ausgabepreis | $9.000 / 1M | $1.280 / 1M |
| Gesamte Eingabe-Token | 296,760 | 250,495 |
| Ausgabe-Token | 4,371 | 76,261 |
| Denk-Token | 92,284 | 0 |
| Antwortzeit (Durchschnitt) | 11.78s | 17.80s |
| Antwortzeit (Maximum) | 84.47s | 206.03s |
| Antwortzeit (Gesamt) | 271.03s | 409.51s |
| Parameter | ~500B insgesamt (~20B aktiv) | ~397B insgesamt (~17B aktiv) |
| Verfügbarkeit | Geschlossen | Geschlossen |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#101 Gemini 3.5 Flash
medium- Kosten
- $0.201
- Zeit
- 112.9s
- Token
- 22,371 tok
#108 Qwen3.7 Plus
none- Kosten
- $0.019
- Zeit
- 213.5s
- Token
- 11,960 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Agentenaufgaben | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 2.8 | 1.6 | 33.3% | 1 | 84.47s | 227,004 | 2,205 | 32,277 | |
| Qwen3.7 Plus | 10.0 | 10.0 | 100.0% | 0 | 143.11s | 151,662 | 18,164 | 0 |
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 10.0 | 10.0 | 100.0% | 0 | 2.09s | 492 | 171 | 3,385 | |
| Qwen3.7 Plus | 6.5 | 10.0 | 50.0% | 0 | 1.38s | 696 | 349 | 0 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 7.9 | 7.5 | 77.8% | 1 | 12.63s | 8,118 | 461 | 24,939 | |
| Qwen3.7 Plus | 5.5 | 10.0 | 33.3% | 0 | 2.15s | 7,911 | 639 | 0 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 10.0 | 10.0 | 100.0% | 0 | 44.36s | 45,684 | 516 | 8,835 | |
| Qwen3.7 Plus | 10.0 | 10.0 | 100.0% | 0 | 117.70s | 71,266 | 56,024 | 0 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 10.0 | 10.0 | 100.0% | 0 | 4.07s | 7,548 | 279 | 3,784 | |
| Qwen3.7 Plus | 10.0 | 10.0 | 100.0% | 0 | 1.43s | 7,794 | 243 | 0 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 5.3 | 10.0 | 33.3% | 0 | 7.28s | 642 | 12 | 10,618 | |
| Qwen3.7 Plus | 5.3 | 10.0 | 33.3% | 0 | 1.04s | 798 | 18 | 0 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 10.0 | 10.0 | 100.0% | 0 | 2.52s | 486 | 115 | 1,144 | |
| Qwen3.7 Plus | 5.3 | 10.0 | 0.0% | 0 | 1.33s | 522 | 78 | 0 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 9.9 | 10.0 | 100.0% | 0 | 2.70s | 615 | 71 | 2,855 | |
| Qwen3.7 Plus | 6.3 | 10.0 | 50.0% | 0 | 929ms | 711 | 72 | 0 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 7.7 | 10.0 | 66.7% | 0 | 2.38s | 558 | 295 | 2,747 | |
| Qwen3.7 Plus | 7.7 | 10.0 | 66.7% | 0 | 1.71s | 714 | 443 | 0 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 10.0 | 10.0 | 100.0% | 0 | 3.81s | 5,457 | 234 | 455 | |
| Qwen3.7 Plus | 10.0 | 10.0 | 100.0% | 0 | 3.54s | 8,211 | 222 | 0 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 10.0 | 10.0 | 100.0% | 0 | 2.75s | 156 | 12 | 1,245 | |
| Qwen3.7 Plus | 3.0 | 10.0 | 0.0% | 0 | 1.21s | 210 | 9 | 0 |
Schnellvergleich
Vergleichspaar wechseln
Gemini 3.5 FlashmediumvsQwen3.8 2.4T A95BhighQwen3.7 PlusnonevsGrok 4.5lowDeepSeek V4 Flash 0731mediumvsQwen3.7 PlusnoneQwen3.7 PlusnonevsGrok 4.6mediumQwen3.7 PlusnonevsStep 3.7 FlashmediumGemini 3.5 FlashmediumvsQwen3.7 MaxnoneQwen3.7 PlusnonevsGLM 5.3highGemini 3.5 FlashmediumvsGLM 5.3highQwen3.7 PlusnonevsGrok 4.5mediumClaude Fable 5.1highvsGemini 3.5 FlashmediumGemini 3.5 FlashmediumvsGLM 5.3 FlashXmaxGPT-6 LunahighvsQwen3.7 Plusnone