- Rang
- #166
- Gesamte Ausgabe-Token
- 267,421
- Antwortzeit (Durchschnitt)
- 78.59s
- Gesamtkosten
- $0.100
Gemma 4 31B (medium) vs Qwen3.5 Plus 2026-02-15
Qwen3.5 Plus 2026-02-15 führt beim Durchschnittsscore mit 6.6 vs 6.2. Qwen3.5 Plus 2026-02-15 hat die niedrigeren Benchmark-Kosten mit $0.073 vs $0.100. Qwen3.5 Plus 2026-02-15 ist schneller mit 9.86s vs 78.59s, mit Erfolgsraten von 65.2% vs 53.0%.
- Rang
- #151
- Gesamte Ausgabe-Token
- 29,370
- Antwortzeit (Durchschnitt)
- 9.86s
- Gesamtkosten
- $0.073
Empfohlenes Modell
Qwen3.5 Plus 2026-02-15
Es hat hier die beste Punktzahl (6.6) und antwortet etwa 8.0x schneller als Gemma 4 31B (medium).
Detaillierter Vergleich
| Metrik | Gemma 4 31B Gemma 4 31B medium Kostenlos verfügbar | Qwen3.5 Plus 2026-02-15 Qwen3.5 Plus 2026-02-15 none |
|---|---|---|
| Punktzahl | 6.2 | 6.6 |
| Rang | #166 | #151 |
| Zuverlässigkeit | 10.0 | 10.0 |
| Konsistenz | 8.7 | 9.4 |
| Versuche | 66/66 | 66/66 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 65.2% | 53.0% |
| Instabile Tests | 3 | 2 |
| Gesamtläufe | 66 | 66 |
| Kosten pro Ergebnis | 1.152 | 0.682 |
| Gesamtkosten | $0.100 | $0.073 |
| Eingabepreis | $0.090 / 1M | $0.260 / 1M |
| Ausgabepreis | $0.340 / 1M | $1.560 / 1M |
| Gesamte Eingabe-Token | 94,969 | 102,655 |
| Ausgabe-Token | 34,399 | 29,370 |
| Denk-Token | 233,022 | 0 |
| Antwortzeit (Durchschnitt) | 78.59s | 9.86s |
| Antwortzeit (Maximum) | 437.40s | 123.00s |
| Antwortzeit (Gesamt) | 1571.84s | 157.77s |
| Parameter | 30.7B | ~397B insgesamt (~17B aktiv) |
| Verfügbarkeit | Open Source | Geschlossen |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#166 Gemma 4 31B
medium- Kosten
- $0.002
- Zeit
- 45.7s
- Token
- 2,696 tok
#151 Qwen3.5 Plus 2026-02-15
none- Kosten
- $0.012
- Zeit
- 153.2s
- Token
- 7,787 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemma 4 31B | 10.0 | 10.0 | 100.0% | 0 | 12.89s | 816 | 962 | 2,046 | |
| Qwen3.5 Plus 2026-02-15 | 4.8 | 10.0 | 25.0% | 0 | 1.91s | 696 | 517 | 0 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemma 4 31B | 4.3 | 5.8 | 22.2% | 1 | 219.76s | 5,568 | 11,098 | 33,212 | |
| Qwen3.5 Plus 2026-02-15 | 4.3 | 7.9 | 11.1% | 1 | 2.05s | 7,913 | 473 | 0 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemma 4 31B | 2.9 | 5.8 | 16.7% | 1 | 433.11s | 77,035 | 12,112 | 157,552 | |
| Qwen3.5 Plus 2026-02-15 | 6.5 | 10.0 | 50.0% | 0 | 64.83s | 75,086 | 27,204 | 0 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemma 4 31B | 10.0 | 10.0 | 100.0% | 0 | 21.11s | 8,334 | 1,822 | 2,951 | |
| Qwen3.5 Plus 2026-02-15 | 10.0 | 10.0 | 100.0% | 0 | 1.89s | 7,794 | 243 | 0 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemma 4 31B | 5.3 | 7.2 | 44.4% | 1 | 59.92s | 853 | 4,280 | 18,729 | |
| Qwen3.5 Plus 2026-02-15 | 7.7 | 10.0 | 66.7% | 0 | 1.24s | 798 | 17 | 0 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemma 4 31B | 10.0 | 10.0 | 100.0% | 0 | 9.57s | 567 | 105 | 888 | |
| Qwen3.5 Plus 2026-02-15 | 4.4 | 3.0 | 33.3% | 1 | 2.26s | 522 | 117 | 0 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemma 4 31B | 10.0 | 10.0 | 100.0% | 0 | 12.76s | 777 | 533 | 2,035 | |
| Qwen3.5 Plus 2026-02-15 | 10.0 | 10.0 | 100.0% | 0 | 1.67s | 711 | 72 | 0 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemma 4 31B | 9.9 | 10.0 | 100.0% | 0 | 26.91s | 801 | 1,795 | 5,595 | |
| Qwen3.5 Plus 2026-02-15 | 7.7 | 10.0 | 66.7% | 0 | 2.71s | 714 | 494 | 0 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemma 4 31B | 3.0 | 10.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 | |
| Qwen3.5 Plus 2026-02-15 | 10.0 | 10.0 | 100.0% | 0 | 3.33s | 8,211 | 222 | 0 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemma 4 31B | 3.0 | 10.0 | 0.0% | 0 | 90.14s | 218 | 1,692 | 10,014 | |
| Qwen3.5 Plus 2026-02-15 | 3.0 | 10.0 | 0.0% | 0 | 1.11s | 210 | 11 | 0 |
Schnellvergleich
Vergleichspaar wechseln
Seed-2.0-LitenonevsGemma 4 31BmediumKostenlos verfügbarGemma 4 31BmediumKostenlos verfügbarvsGPT-5.6 LunalowClaude Sonnet 5nonevsGemma 4 31BmediumKostenlos verfügbarLaguna XS 2.1mediumKostenlos verfügbarvsQwen3.5 Plus 2026-02-15noneGemini 3.1 Flash LitelowvsQwen3.5 Plus 2026-02-15noneQwen3.5 Plus 2026-02-15nonevsInkling SmallmediumGemma 4 31BmediumKostenlos verfügbarvsQwen3.7 FlashnoneGemma 4 31BmediumKostenlos verfügbarvsInklinglowGemini 3.1 Flash Lite PreviewlowvsQwen3.5 Plus 2026-02-15noneGemini 3.5 Flash LitelowvsQwen3.5 Plus 2026-02-15noneGemma 4 31BmediumKostenlos verfügbarvsQwen3.6 FlashnoneGemma 4 31BmediumKostenlos verfügbarvsQwen3.5 Plus 2026-04-20none