- Rang
- #22
- Gesamte Ausgabe-Token
- 154,908
- Antwortzeit (Durchschnitt)
- 14.50s
- Gesamtkosten
- $0.653
Gemini 3.8 Flash (medium) vs Qwen3.8 Max (0902) (high)
Gemini 3.8 Flash (medium) führt beim Durchschnittsscore mit 9.1 vs 8.9. Gemini 3.8 Flash (medium) hat die niedrigeren Benchmark-Kosten mit $0.653 vs $2.736. Gemini 3.8 Flash (medium) ist schneller mit 14.50s vs 185.56s, mit Erfolgsraten von 92.4% vs 86.4%.
- Rang
- #31
- Gesamte Ausgabe-Token
- 419,443
- Antwortzeit (Durchschnitt)
- 185.56s
- Gesamtkosten
- $2.736
Empfohlenes Modell
Gemini 3.8 Flash (medium)
Es hat hier die beste Punktzahl (9.1) und kostet etwa 4.2x weniger als Qwen3.8 Max (0902) (high).
Detaillierter Vergleich
| Metrik | Gemini 3.8 Flash Gemini 3.8 Flash medium | Qwen3.8 Max (0902) Qwen3.8 Max (0902) high |
|---|---|---|
| Punktzahl | 9.1 | 8.9 |
| Rang | #22 | #31 |
| Zuverlässigkeit | 10.0 | 9.8 |
| Konsistenz | 9.3 | 9.0 |
| Versuche | 66/66 | 66/66 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 92.4% | 86.4% |
| Instabile Tests | 2 | 3 |
| Gesamtläufe | 66 | 66 |
| Kosten pro Ergebnis | 3.436 | 16.089 |
| Gesamtkosten | $0.653 | $2.736 |
| Eingabepreis | $0.750 / 1M | $2.000 / 1M |
| Ausgabepreis | $3.750 / 1M | $6.000 / 1M |
| Gesamte Eingabe-Token | 95,793 | 109,226 |
| Ausgabe-Token | 7,066 | 6,890 |
| Denk-Token | 147,842 | 412,553 |
| Antwortzeit (Durchschnitt) | 14.50s | 185.56s |
| Antwortzeit (Maximum) | 108.60s | 912.78s |
| Antwortzeit (Gesamt) | 318.92s | 4082.41s |
| Parameter | ~500B insgesamt (~20B aktiv) | 2.4T insgesamt (~100B aktiv) |
| Verfügbarkeit | Geschlossen | Geschlossen |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#22 Gemini 3.8 Flash
medium- Kosten
- $0.037
- Zeit
- 54.6s
- Token
- 9,712 tok
#31 Qwen3.8 Max (0902)
high
Reached the allocated time limit (600 seconds) without receiving showcase output.
- Kosten
- $0.000
- Zeit
- 600.0s
- Token
- 0 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.8 Flash | 10.0 | 10.0 | 100.0% | 0 | 2.66s | 492 | 145 | 3,131 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 15.86s | 1,128 | 263 | 6,631 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.8 Flash | 8.0 | 9.9 | 66.7% | 0 | 11.69s | 8,118 | 454 | 19,433 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 253.22s | 8,235 | 418 | 91,734 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.8 Flash | 8.7 | 6.9 | 83.3% | 1 | 60.28s | 71,646 | 5,615 | 59,676 | |
| Qwen3.8 Max (0902) | 8.7 | 6.9 | 83.3% | 1 | 110.39s | 79,527 | 5,215 | 28,102 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.8 Flash | 10.0 | 10.0 | 100.0% | 0 | 5.74s | 7,548 | 279 | 4,386 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 16.37s | 8,010 | 261 | 3,598 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.8 Flash | 8.2 | 7.2 | 88.9% | 1 | 31.77s | 644 | 12 | 44,973 | |
| Qwen3.8 Max (0902) | 5.9 | 7.2 | 55.6% | 1 | 658.46s | 842 | 31 | 154,450 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.8 Flash | 10.0 | 10.0 | 100.0% | 0 | 3.65s | 486 | 78 | 1,185 | |
| Qwen3.8 Max (0902) | 6.5 | 3.4 | 66.7% | 1 | 75.11s | 630 | 80 | 8,110 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.8 Flash | 10.0 | 10.0 | 100.0% | 0 | 4.81s | 615 | 72 | 2,944 | |
| Qwen3.8 Max (0902) | 9.8 | 10.0 | 100.0% | 0 | 7.55s | 927 | 86 | 1,823 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.8 Flash | 10.0 | 10.0 | 100.0% | 0 | 2.73s | 558 | 151 | 2,720 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 134.14s | 1,038 | 268 | 47,351 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.8 Flash | 10.0 | 10.0 | 100.0% | 0 | 18.47s | 5,530 | 249 | 6,512 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 5.21s | 8,571 | 249 | 243 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.8 Flash | 10.0 | 10.0 | 100.0% | 0 | 5.94s | 156 | 11 | 2,882 | |
| Qwen3.8 Max (0902) | 3.0 | 10.0 | 0.0% | 0 | 532.59s | 318 | 19 | 70,511 |
Schnellvergleich
Vergleichspaar wechseln
Gemini 3.8 FlashmediumvsQwen3.8 Max (0902)lowGPT-5.3-CodexmediumvsQwen3.8 Max (0902)highSeed 2.1 TurbolowvsGemini 3.8 FlashmediumGPT-5.5mediumvsQwen3.8 Max (0902)highGemini 3.5 FlashmediumvsQwen3.8 Max (0902)highClaude Opus 5highvsGemini 3.8 FlashmediumClaude Fable 5.1highvsGemini 3.8 FlashmediumGemini 3.5 FlashlowvsQwen3.8 Max (0902)highSeed 2.1 TurbolowvsQwen3.8 Max (0902)highGemini 3.8 FlashmediumvsGrok 4.5highMuse Spark 1.3mediumvsQwen3.8 Max (0902)highClaude Opus 4.8mediumvsQwen3.8 Max (0902)high