- Rang
- #19
- Gesamte Ausgabe-Token
- 37,053
- Antwortzeit (Durchschnitt)
- 3.85s
- Gesamtkosten
- $0.207
Gemini 3.7 Flash (low) vs Qwen3.8 Max (0902) (low)
Gemini 3.7 Flash (low) führt beim Durchschnittsscore mit 9.2 vs 9.1. Gemini 3.7 Flash (low) hat die niedrigeren Benchmark-Kosten mit $0.207 vs $0.664. Gemini 3.7 Flash (low) ist schneller mit 3.85s vs 24.21s, mit Erfolgsraten von 95.5% vs 86.4%.
- Rang
- #23
- Gesamte Ausgabe-Token
- 75,865
- Antwortzeit (Durchschnitt)
- 24.21s
- Gesamtkosten
- $0.664
Empfohlenes Modell
Gemini 3.7 Flash (low)
Es hat hier die beste Punktzahl (9.2) und kostet etwa 3.2x weniger als Qwen3.8 Max (0902) (low).
Detaillierter Vergleich
| Metrik | Gemini 3.7 Flash Gemini 3.7 Flash low | Qwen3.8 Max (0902) Qwen3.8 Max (0902) low |
|---|---|---|
| Punktzahl | 9.2 | 9.1 |
| Rang | #19 | #23 |
| Zuverlässigkeit | 10.0 | 10.0 |
| Konsistenz | 9.2 | 9.3 |
| Versuche | 66/66 | 66/66 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 95.5% | 86.4% |
| Instabile Tests | 2 | 2 |
| Gesamtläufe | 66 | 66 |
| Kosten pro Ergebnis | 0.517 | 3.684 |
| Gesamtkosten | $0.207 | $0.664 |
| Eingabepreis | $0.750 / 1M | $2.000 / 1M |
| Ausgabepreis | $3.750 / 1M | $6.000 / 1M |
| Gesamte Eingabe-Token | 90,322 | 103,954 |
| Ausgabe-Token | 6,294 | 6,322 |
| Denk-Token | 30,759 | 69,543 |
| Antwortzeit (Durchschnitt) | 3.85s | 24.21s |
| Antwortzeit (Maximum) | 19.44s | 207.79s |
| Antwortzeit (Gesamt) | 84.80s | 532.62s |
| Parameter | ~500B insgesamt (~20B aktiv) | 2.4T insgesamt (~100B aktiv) |
| Verfügbarkeit | Geschlossen | Geschlossen |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#19 Gemini 3.7 Flash
low- Kosten
- $0.010
- Zeit
- 23.5s
- Token
- 5,210 tok
#23 Qwen3.8 Max (0902)
low- Kosten
- $0.014
- Zeit
- 41.2s
- Token
- 2,421 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.7 Flash | 10.0 | 10.0 | 100.0% | 0 | 1.54s | 492 | 99 | 1,398 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 4.72s | 984 | 212 | 1,854 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.7 Flash | 7.6 | 7.2 | 77.8% | 1 | 6.20s | 8,118 | 461 | 11,508 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 37.42s | 8,127 | 485 | 17,404 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.7 Flash | 10.0 | 10.0 | 100.0% | 0 | 13.00s | 66,250 | 4,873 | 8,108 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 113.88s | 74,767 | 4,562 | 29,335 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.7 Flash | 10.0 | 10.0 | 100.0% | 0 | 2.15s | 7,548 | 278 | 1,093 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 9.94s | 7,938 | 261 | 2,254 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.7 Flash | 8.2 | 7.2 | 88.9% | 1 | 3.09s | 642 | 12 | 3,029 | |
| Qwen3.8 Max (0902) | 5.3 | 7.2 | 44.4% | 1 | 34.93s | 1,014 | 45 | 13,881 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.7 Flash | 10.0 | 10.0 | 100.0% | 0 | 2.76s | 486 | 81 | 1,043 | |
| Qwen3.8 Max (0902) | 6.1 | 3.1 | 66.7% | 1 | 8.91s | 594 | 120 | 820 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.7 Flash | 10.0 | 10.0 | 100.0% | 0 | 2.47s | 615 | 72 | 1,778 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 4.32s | 855 | 90 | 866 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.7 Flash | 10.0 | 10.0 | 100.0% | 0 | 1.92s | 558 | 166 | 1,580 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 4.49s | 930 | 275 | 1,248 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.7 Flash | 10.0 | 10.0 | 100.0% | 0 | 4.10s | 5,457 | 241 | 160 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 4.73s | 8,463 | 249 | 126 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.7 Flash | 10.0 | 10.0 | 100.0% | 0 | 2.92s | 156 | 11 | 1,062 | |
| Qwen3.8 Max (0902) | 3.0 | 10.0 | 0.0% | 0 | 13.28s | 282 | 23 | 1,755 |
Schnellvergleich
Vergleichspaar wechseln
Gemini 3.8 FlashmediumvsQwen3.8 Max (0902)lowClaude Opus 5highvsGemini 3.7 FlashlowClaude Opus 5mediumvsGemini 3.7 FlashlowClaude Opus 5mediumvsQwen3.8 Max (0902)lowClaude Opus 5highvsQwen3.8 Max (0902)lowClaude Fable 5.1highvsQwen3.8 Max (0902)lowGemini 3.7 FlashlowvsGrok 4.6highGemini 3.5 FlashmediumvsQwen3.8 Max (0902)lowGPT-5.5mediumvsQwen3.8 Max (0902)lowGemini 3.1 Pro PreviewmediumvsQwen3.8 Max (0902)lowGemini 3.7 FlashlowvsGPT-5.6 SolhighGemini 3.7 FlashlowvsGPT-6 Astramedium