- Rang
- #101
- Gesamte Ausgabe-Token
- 62,356
- Antwortzeit (Durchschnitt)
- 4.38s
- Gesamtkosten
- $0.120
Gemini 3.1 Flash Lite (medium) vs Qwen3.8 2.4T A95B (high)
Qwen3.8 2.4T A95B (high) führt beim Durchschnittsscore mit 7.4 vs 7.3. Gemini 3.1 Flash Lite (medium) hat die niedrigeren Benchmark-Kosten mit $0.120 vs $2.357. Gemini 3.1 Flash Lite (medium) ist schneller mit 4.38s vs 120.59s, mit Erfolgsraten von 62.1% vs 74.2%.
- Rang
- #95
- Gesamte Ausgabe-Token
- 456,028
- Antwortzeit (Durchschnitt)
- 120.59s
- Gesamtkosten
- $2.357
Empfohlenes Modell
Gemini 3.1 Flash Lite (medium)
Die Punktzahl bleibt nah an der besten hier (7.3 vs 7.4) und es kostet etwa 19.7x weniger als Qwen3.8 2.4T A95B (high).
Detaillierter Vergleich
| Metrik | Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite medium | Qwen3.8 2.4T A95B Qwen3.8 2.4T A95B high |
|---|---|---|
| Punktzahl | 7.3 | 7.4 |
| Rang | #101 | #95 |
| Zuverlässigkeit | 10.0 | 9.4 |
| Konsistenz | 9.2 | 8.3 |
| Versuche | 66/66 | 66/66 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 62.1% | 74.2% |
| Instabile Tests | 2 | 4 |
| Gesamtläufe | 66 | 66 |
| Kosten pro Ergebnis | 0.922 | 16.832 |
| Gesamtkosten | $0.120 | $2.357 |
| Eingabepreis | $0.250 / 1M | $2.000 / 1M |
| Ausgabepreis | $1.500 / 1M | $6.000 / 1M |
| Gesamte Eingabe-Token | 104,925 | 108,931 |
| Ausgabe-Token | 9,168 | 112,801 |
| Denk-Token | 53,188 | 343,227 |
| Antwortzeit (Durchschnitt) | 4.38s | 120.59s |
| Antwortzeit (Maximum) | 26.22s | 532.28s |
| Antwortzeit (Gesamt) | 96.32s | 2653.05s |
| Parameter | ~150B insgesamt (~10B aktiv) | 2.4T insgesamt (95B aktiv) |
| Verfügbarkeit | Geschlossen | Gewichte verfügbar |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#101 Gemini 3.1 Flash Lite
medium- Kosten
- $0.003
- Zeit
- 5.3s
- Token
- 1,754 tok
#95 Qwen3.8 2.4T A95B
high
Ungültiges SVG
- Kosten
- $0.000
- Zeit
- 600.0s
- Token
- 0 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite | 9.1 | 10.0 | 75.0% | 0 | 2.39s | 502 | 604 | 4,201 | |
| Qwen3.8 2.4T A95B | 10.0 | 10.0 | 100.0% | 0 | 24.22s | 1,128 | 305 | 4,864 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite | 5.5 | 10.0 | 33.3% | 0 | 3.81s | 8,134 | 459 | 8,978 | |
| Qwen3.8 2.4T A95B | 5.9 | 6.3 | 55.6% | 1 | 160.52s | 6,399 | 3,310 | 48,078 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite | 7.2 | 9.1 | 50.0% | 0 | 18.55s | 80,983 | 7,241 | 20,231 | |
| Qwen3.8 2.4T A95B | 6.9 | 5.9 | 66.7% | 1 | 266.12s | 81,205 | 7,791 | 41,921 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite | 10.0 | 10.0 | 100.0% | 0 | 2.60s | 7,362 | 279 | 2,845 | |
| Qwen3.8 2.4T A95B | 10.0 | 10.0 | 100.0% | 0 | 13.67s | 7,928 | 550 | 2,307 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite | 2.9 | 7.2 | 11.1% | 1 | 3.93s | 650 | 15 | 7,223 | |
| Qwen3.8 2.4T A95B | 4.1 | 6.5 | 22.2% | 1 | 301.08s | 964 | 11,279 | 139,028 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite | 10.0 | 10.0 | 100.0% | 0 | 2.60s | 488 | 84 | 1,142 | |
| Qwen3.8 2.4T A95B | 6.1 | 3.1 | 66.7% | 1 | 11.38s | 630 | 2,020 | 2,165 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite | 9.9 | 10.0 | 100.0% | 0 | 2.59s | 623 | 75 | 3,320 | |
| Qwen3.8 2.4T A95B | 9.8 | 10.0 | 100.0% | 0 | 11.45s | 927 | 245 | 1,727 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite | 7.6 | 7.2 | 77.8% | 1 | 1.95s | 568 | 165 | 2,450 | |
| Qwen3.8 2.4T A95B | 10.0 | 10.0 | 100.0% | 0 | 65.54s | 989 | 698 | 15,073 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite | 10.0 | 10.0 | 100.0% | 0 | 4.55s | 5,457 | 234 | 921 | |
| Qwen3.8 2.4T A95B | 10.0 | 10.0 | 100.0% | 0 | 32.93s | 8,481 | 302 | 656 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.1 Flash Lite | 3.0 | 10.0 | 0.0% | 0 | 3.08s | 158 | 12 | 1,877 | |
| Qwen3.8 2.4T A95B | 3.0 | 10.0 | 0.0% | 0 | 347.95s | 280 | 86,301 | 87,408 |
Schnellvergleich
Vergleichspaar wechseln
Gemini 3.1 Flash LitemediumvsQwen3.7 PlusnoneQwen3.8 2.4T A95BhighvsGrok 4.6lowGemini 3 Flash PreviewlowvsQwen3.8 2.4T A95BhighLongCat 2.0mediumvsQwen3.8 2.4T A95BhighGemini 3.1 Flash LitemediumvsKAT-Coder-Pro V2.5lowClaude Opus 4.8nonevsGemini 3.1 Flash LitemediumGemini 3.1 Flash LitemediumvsGLM 5.3highGPT-5.6 LunamediumvsQwen3.8 2.4T A95BhighClaude Sonnet 4.6nonevsGemini 3.1 Flash LitemediumKimi K2.7 CodemediumvsQwen3.8 2.4T A95BhighClaude Sonnet 4.6nonevsQwen3.8 2.4T A95BhighGemini 3.1 Flash Lite PreviewmediumvsQwen3.8 2.4T A95Bhigh