- Rang
- #27
- Gesamte Ausgabe-Token
- 62,173
- Antwortzeit (Durchschnitt)
- 8.48s
- Gesamtkosten
- $0.665
Gemini 3.5 Flash (medium) vs Qwen3.8 Max (0902) (low)
Qwen3.8 Max (0902) (low) führt beim Durchschnittsscore mit 9.1 vs 9.0. Qwen3.8 Max (0902) (low) hat die niedrigeren Benchmark-Kosten mit $0.664 vs $0.665. Gemini 3.5 Flash (medium) ist schneller mit 8.48s vs 24.21s, mit Erfolgsraten von 83.3% vs 86.4%.
- Rang
- #23
- Gesamte Ausgabe-Token
- 75,865
- Antwortzeit (Durchschnitt)
- 24.21s
- Gesamtkosten
- $0.664
Empfohlenes Modell
Gemini 3.5 Flash (medium)
Die Punktzahl bleibt nah an der besten hier (9.0 vs 9.1) und es antwortet etwa 2.9x schneller als Qwen3.8 Max (0902) (low).
Detaillierter Vergleich
| Metrik | Gemini 3.5 Flash Gemini 3.5 Flash medium | Qwen3.8 Max (0902) Qwen3.8 Max (0902) low |
|---|---|---|
| Punktzahl | 9.0 | 9.1 |
| Rang | #27 | #23 |
| Zuverlässigkeit | 10.0 | 10.0 |
| Konsistenz | 9.7 | 9.3 |
| Versuche | 66/66 | 66/66 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 83.3% | 86.4% |
| Instabile Tests | 1 | 2 |
| Gesamtläufe | 66 | 66 |
| Kosten pro Ergebnis | 3.690 | 3.684 |
| Gesamtkosten | $0.665 | $0.664 |
| Eingabepreis | $1.500 / 1M | $2.000 / 1M |
| Ausgabepreis | $9.000 / 1M | $6.000 / 1M |
| Gesamte Eingabe-Token | 69,756 | 103,954 |
| Ausgabe-Token | 2,166 | 6,322 |
| Denk-Token | 60,007 | 69,543 |
| Antwortzeit (Durchschnitt) | 8.48s | 24.21s |
| Antwortzeit (Maximum) | 76.68s | 207.79s |
| Antwortzeit (Gesamt) | 186.57s | 532.62s |
| Parameter | ~500B insgesamt (~20B aktiv) | 2.4T insgesamt (~100B aktiv) |
| Verfügbarkeit | Geschlossen | Geschlossen |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#27 Gemini 3.5 Flash
medium- Kosten
- $0.201
- Zeit
- 112.9s
- Token
- 22,371 tok
#23 Qwen3.8 Max (0902)
low- Kosten
- $0.014
- Zeit
- 41.2s
- Token
- 2,421 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 10.0 | 10.0 | 100.0% | 0 | 2.09s | 492 | 171 | 3,385 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 4.72s | 984 | 212 | 1,854 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 7.9 | 7.5 | 77.8% | 1 | 12.63s | 8,118 | 461 | 24,939 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 37.42s | 8,127 | 485 | 17,404 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 10.0 | 10.0 | 100.0% | 0 | 44.36s | 45,684 | 516 | 8,835 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 113.88s | 74,767 | 4,562 | 29,335 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 10.0 | 10.0 | 100.0% | 0 | 4.07s | 7,548 | 279 | 3,784 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 9.94s | 7,938 | 261 | 2,254 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 5.3 | 10.0 | 33.3% | 0 | 7.28s | 642 | 12 | 10,618 | |
| Qwen3.8 Max (0902) | 5.3 | 7.2 | 44.4% | 1 | 34.93s | 1,014 | 45 | 13,881 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 10.0 | 10.0 | 100.0% | 0 | 2.52s | 486 | 115 | 1,144 | |
| Qwen3.8 Max (0902) | 6.1 | 3.1 | 66.7% | 1 | 8.91s | 594 | 120 | 820 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 9.9 | 10.0 | 100.0% | 0 | 2.70s | 615 | 71 | 2,855 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 4.32s | 855 | 90 | 866 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 7.7 | 10.0 | 66.7% | 0 | 2.38s | 558 | 295 | 2,747 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 4.49s | 930 | 275 | 1,248 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 10.0 | 10.0 | 100.0% | 0 | 3.81s | 5,457 | 234 | 455 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 4.73s | 8,463 | 249 | 126 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 10.0 | 10.0 | 100.0% | 0 | 2.75s | 156 | 12 | 1,245 | |
| Qwen3.8 Max (0902) | 3.0 | 10.0 | 0.0% | 0 | 13.28s | 282 | 23 | 1,755 |
Schnellvergleich
Vergleichspaar wechseln
Gemini 3.8 FlashmediumvsQwen3.8 Max (0902)lowClaude Fable 5.1highvsGemini 3.5 FlashmediumGemini 3.5 FlashmediumvsGrok 4.5highGemini 3.5 FlashmediumvsQwen3.8 Max (0902)highGemini 3.5 FlashmediumvsMuse Spark 1.3highClaude Opus 5mediumvsQwen3.8 Max (0902)lowClaude Opus 5highvsQwen3.8 Max (0902)lowSeed 2.1 TurbolowvsGemini 3.5 FlashmediumClaude Fable 5.1highvsQwen3.8 Max (0902)lowSeed 2.1 TurbohighvsGemini 3.5 FlashmediumGPT-5.5mediumvsQwen3.8 Max (0902)lowGemini 3.1 Pro PreviewmediumvsQwen3.8 Max (0902)low