- Rang
- #231
- Gesamte Ausgabe-Token
- 153,595
- Antwortzeit (Durchschnitt)
- 14.13s
- Gesamtkosten
- $1.752
Gemini 3.5 Flash vs Granite 4.2 8B (medium)
Gemini 3.5 Flash führt beim Durchschnittsscore mit 6.1 vs 6.1. Granite 4.2 8B (medium) hat die niedrigeren Benchmark-Kosten mit $0.029 vs $1.752. Gemini 3.5 Flash ist schneller mit 14.13s vs 50.47s, mit Erfolgsraten von 68.1% vs 37.7%.
Verglichene Modelle
- Rang
- #235
- Gesamte Ausgabe-Token
- 50,147
- Antwortzeit (Durchschnitt)
- 50.47s
- Gesamtkosten
- $0.029
Empfohlenes Modell
Gemini 3.5 Flash
Es hat hier die beste Punktzahl (6.1) und antwortet etwa 3.6x schneller als Granite 4.2 8B (medium).
Detaillierter Vergleich
| Metrik | Gemini 3.5 Flash Gemini 3.5 Flash none | Granite 4.2 8B Granite 4.2 8B medium |
|---|---|---|
| Punktzahl | 6.1 | 6.1 |
| Rang | #231 | #235 |
| Zuverlässigkeit | 10.0 | 8.9 |
| Konsistenz | 8.6 | 9.7 |
| Versuche | 69/69 | 69/69 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 68.1% | 37.7% |
| Instabile Tests | 4 | 1 |
| Gesamtläufe | 69 | 69 |
| Kosten pro Ergebnis | 12.511 | 0.354 |
| Gesamtkosten | $1.752 | $0.029 |
| Eingabepreis | $1.500 / 1M | $0.060 / 1M |
| Ausgabepreis | $9.000 / 1M | $0.250 / 1M |
| Gesamte Eingabe-Token | 246,061 | 259,708 |
| Ausgabe-Token | 153,595 | 16,567 |
| Denk-Token | 0 | 33,580 |
| Antwortzeit (Durchschnitt) | 14.13s | 50.47s |
| Antwortzeit (Maximum) | 85.26s | 557.96s |
| Antwortzeit (Gesamt) | 268.55s | 1160.91s |
| Parameter | ~500B insgesamt (~20B aktiv) | 8B |
| Verfügbarkeit | Geschlossen | Open Source |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#231 Gemini 3.5 Flash
none- Kosten
- $0.225
- Zeit
- 125.5s
- Token
- 25,004 tok
#235 IBM: Granite 4.2 8B
medium
Provider returned error
- Kosten
- $0.000
- Zeit
- 0.2s
- Token
- 0 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Agentenaufgaben | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 2.8 | 1.6 | 33.3% | 1 | 85.26s | 232,209 | 34,495 | 0 | |
| Granite 4.2 8B | 10.0 | 10.0 | 100.0% | 0 | 149.50s | 206,799 | 9,509 | 21,308 |
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 10.0 | 10.0 | 100.0% | 0 | 2.53s | 492 | 5,101 | 0 | |
| Granite 4.2 8B | 8.4 | 10.0 | 75.0% | 0 | 10.34s | 777 | 1,452 | 889 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 8.8 | 7.8 | 88.9% | 1 | 34.69s | 8,122 | 75,927 | 0 | |
| Granite 4.2 8B | 5.5 | 10.0 | 33.3% | 0 | 12.09s | 8,439 | 2,445 | 3,900 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 3.0 | 10.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 | |
| Granite 4.2 8B | 3.0 | 10.0 | 0.0% | 0 | 291.12s | 24,807 | 1,902 | 6,258 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 6.5 | 10.0 | 50.0% | 0 | 8.10s | 2,781 | 5,895 | 0 | |
| Granite 4.2 8B | 6.5 | 10.0 | 50.0% | 0 | 1.43s | 7,683 | 270 | 75 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 5.3 | 7.2 | 44.4% | 1 | 12.18s | 642 | 19,492 | 0 | |
| Granite 4.2 8B | 5.3 | 10.0 | 33.3% | 0 | 13.96s | 876 | 154 | 290 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 10.0 | 10.0 | 100.0% | 0 | 3.46s | 486 | 1,620 | 0 | |
| Granite 4.2 8B | 4.0 | 10.0 | 0.0% | 0 | 605ms | 561 | 102 | 24 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 9.8 | 10.0 | 100.0% | 0 | 3.38s | 615 | 3,928 | 0 | |
| Granite 4.2 8B | 3.8 | 6.0 | 33.3% | 1 | 36.86s | 636 | 127 | 425 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 10.0 | 10.0 | 100.0% | 0 | 3.13s | 558 | 4,640 | 0 | |
| Granite 4.2 8B | 3.1 | 10.0 | 0.0% | 0 | 75.99s | 469 | 206 | 56 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 3.0 | 10.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 | |
| Granite 4.2 8B | 10.0 | 10.0 | 100.0% | 0 | 2.28s | 8,412 | 359 | 214 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Gemini 3.5 Flash | 2.8 | 1.6 | 33.3% | 1 | 4.87s | 156 | 2,497 | 0 | |
| Granite 4.2 8B | 3.0 | 10.0 | 0.0% | 0 | 2.24s | 249 | 41 | 141 |
Schnellvergleich
Vergleichspaar wechseln
Granite 4.2 8BmediumvsKAT-Coder-Pro V2.5noneGranite 4.2 8BmediumvsQwen3.5 Plus 2026-04-20noneGranite 4.2 8BmediumvsInklingnoneKostenlos verfügbarTrinity Large ThinkingmediumvsGemini 3.5 FlashnoneClaude Fable 5.1lowvsGemini 3.5 FlashnoneGranite 4.2 8BmediumvsGLM 5.3 FlashXlowGemini 3.5 FlashnonevsKAT-Coder-Pro V2.5mediumGranite 4.2 8BmediumvsMiMo-V2.6-PrononeClaude Fable 5.1lowvsGranite 4.2 8BmediumGemini 3.5 FlashnonevsSpace Bunny AlphaxhighSeed-2.0-LitenonevsGranite 4.2 8BmediumGemini 3.1 Flash Lite PreviewnonevsGranite 4.2 8Bmedium