- Rang
- #38
- Gesamte Ausgabe-Token
- 204,625
- Antwortzeit (Durchschnitt)
- 10.05s
- Gesamtkosten
- $0.540
Gemini 3.5 Flash Lite (high) vs Qwen3.8 Max (0902) (medium)
Der Durchschnittsscore ist mit 8.8 vs 8.8 praktisch gleichauf. Gemini 3.5 Flash Lite (high) hat die niedrigeren Benchmark-Kosten mit $0.540 vs $0.677. Gemini 3.5 Flash Lite (high) ist schneller mit 10.05s vs 26.01s, mit Erfolgsraten von 83.3% vs 83.3%.
- Rang
- #36
- Gesamte Ausgabe-Token
- 80,678
- Antwortzeit (Durchschnitt)
- 26.01s
- Gesamtkosten
- $0.677
Empfohlenes Modell
Gemini 3.5 Flash Lite (high)
Es hat hier die beste Punktzahl (8.8) und antwortet etwa 2.6x schneller als Qwen3.8 Max (0902) (medium).
Detaillierter Vergleich
| Metrik | Gemini 3.5 Flash Lite Gemini 3.5 Flash Lite high | Qwen3.8 Max (0902) Qwen3.8 Max (0902) medium |
|---|---|---|
| Punktzahl | 8.8 | 8.8 |
| Rang | #38 | #36 |
| Zuverlässigkeit | 10.0 | 10.0 |
| Konsistenz | 9.3 | 9.3 |
| Versuche | 66/66 | 66/66 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 83.3% | 83.3% |
| Instabile Tests | 2 | 2 |
| Gesamtläufe | 66 | 66 |
| Kosten pro Ergebnis | 3.174 | 3.981 |
| Gesamtkosten | $0.540 | $0.677 |
| Eingabepreis | $0.300 / 1M | $2.000 / 1M |
| Ausgabepreis | $2.500 / 1M | $6.000 / 1M |
| Gesamte Eingabe-Token | 93,046 | 96,323 |
| Ausgabe-Token | 5,884 | 5,961 |
| Denk-Token | 198,741 | 74,717 |
| Antwortzeit (Durchschnitt) | 10.05s | 26.01s |
| Antwortzeit (Maximum) | 36.22s | 168.09s |
| Antwortzeit (Gesamt) | 221.06s | 572.19s |
| Parameter | ~150B insgesamt (~10B aktiv) | 2.4T insgesamt (~100B aktiv) |
| Verfügbarkeit | Geschlossen | Geschlossen |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#38 Gemini 3.5 Flash Lite
high- Kosten
- $0.025
- Zeit
- 36.8s
- Token
- 9,964 tok
#36 Qwen3.8 Max (0902)
medium- Kosten
- $0.036
- Zeit
- 108.3s
- Token
- 5,980 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash Lite | 10.0 | 10.0 | 100.0% | 0 | 2.96s | 498 | 142 | 7,917 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 5.03s | 672 | 295 | 2,003 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash Lite | 8.4 | 7.4 | 88.9% | 1 | 16.58s | 8,130 | 434 | 57,369 | |
| Qwen3.8 Max (0902) | 8.4 | 7.4 | 88.9% | 1 | 45.74s | 7,893 | 551 | 20,628 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash Lite | 9.9 | 10.0 | 100.0% | 0 | 27.90s | 68,427 | 4,360 | 52,993 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 94.38s | 68,852 | 3,895 | 24,303 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash Lite | 10.0 | 10.0 | 100.0% | 0 | 3.17s | 7,362 | 279 | 5,636 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 10.54s | 7,782 | 261 | 2,591 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash Lite | 3.6 | 7.2 | 22.2% | 1 | 23.14s | 656 | 17 | 54,566 | |
| Qwen3.8 Max (0902) | 3.6 | 7.2 | 22.2% | 1 | 49.45s | 780 | 44 | 19,572 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash Lite | 10.0 | 10.0 | 100.0% | 0 | 3.10s | 488 | 81 | 2,124 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 7.56s | 516 | 202 | 689 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash Lite | 9.8 | 10.0 | 100.0% | 0 | 2.16s | 625 | 69 | 3,513 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 4.24s | 699 | 90 | 886 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash Lite | 10.0 | 10.0 | 100.0% | 0 | 2.09s | 572 | 183 | 4,004 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 5.89s | 696 | 353 | 1,599 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash Lite | 10.0 | 10.0 | 100.0% | 0 | 4.55s | 6,132 | 310 | 2,955 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 5.93s | 8,229 | 249 | 194 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash Lite | 3.0 | 10.0 | 0.0% | 0 | 9.68s | 156 | 9 | 7,664 | |
| Qwen3.8 Max (0902) | 3.0 | 10.0 | 0.0% | 0 | 17.01s | 204 | 21 | 2,252 |
Schnellvergleich
Vergleichspaar wechseln
Claude Opus 4.8mediumvsGemini 3.5 Flash LitehighGemini 3.5 Flash LitehighvsMuse Spark 1.3mediumGemini 3.5 FlashlowvsQwen3.8 Max (0902)mediumClaude Opus 5lowvsGemini 3.5 Flash LitehighGemini 3.5 Flash LitehighvsGLM 5.3 FlashmaxClaude Opus 4.7mediumvsGemini 3.5 Flash LitehighClaude Opus 5lowvsQwen3.8 Max (0902)mediumGemini 3.6 FlashlowvsQwen3.8 Max (0902)mediumQwen3.8 Max (0902)mediumvsGLM 5.3 FlashmaxSeed 2.1 TurbohighvsQwen3.8 Max (0902)mediumGemini 3.5 Flash LitehighvsMuse Spark 1.2mediumGemini 3.5 Flash LitehighvsMuse Spark 1.1medium