- Rang
- #230
- Gesamte Ausgabe-Token
- 26,073
- Antwortzeit (Durchschnitt)
- 11.40s
- Gesamtkosten
- $3.395
Claude Fable 5.1 (low) vs Granite 4.2 8B (medium)
Claude Fable 5.1 (low) führt beim Durchschnittsscore mit 6.2 vs 6.1. Granite 4.2 8B (medium) hat die niedrigeren Benchmark-Kosten mit $0.029 vs $3.395. Claude Fable 5.1 (low) ist schneller mit 11.40s vs 50.47s, mit Erfolgsraten von 55.1% vs 37.7%.
Verglichene Modelle
- Rang
- #235
- Gesamte Ausgabe-Token
- 50,147
- Antwortzeit (Durchschnitt)
- 50.47s
- Gesamtkosten
- $0.029
Empfohlenes Modell
Granite 4.2 8B (medium)
Die Punktzahl bleibt nah an der besten hier (6.1 vs 6.2) und es kostet etwa 120.8x weniger als Claude Fable 5.1 (low).
Detaillierter Vergleich
| Metrik | Claude Fable 5.1 Claude Fable 5.1 low | Granite 4.2 8B Granite 4.2 8B medium |
|---|---|---|
| Punktzahl | 6.2 | 6.1 |
| Rang | #230 | #235 |
| Zuverlässigkeit | 10.0 | 8.9 |
| Konsistenz | 8.9 | 9.7 |
| Versuche | 69/69 | 69/69 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 55.1% | 37.7% |
| Instabile Tests | 3 | 1 |
| Gesamtläufe | 69 | 69 |
| Kosten pro Ergebnis | 30.862 | 0.354 |
| Gesamtkosten | $3.395 | $0.029 |
| Eingabepreis | $10.000 / 1M | $0.060 / 1M |
| Ausgabepreis | $50.000 / 1M | $0.250 / 1M |
| Gesamte Eingabe-Token | 209,116 | 259,708 |
| Ausgabe-Token | 10,031 | 16,567 |
| Denk-Token | 16,042 | 33,580 |
| Antwortzeit (Durchschnitt) | 11.40s | 50.47s |
| Antwortzeit (Maximum) | 34.77s | 557.96s |
| Antwortzeit (Gesamt) | 262.14s | 1160.91s |
| Parameter | ~9.5T insgesamt (~878B aktiv) | 8B |
| Verfügbarkeit | Geschlossen | Open Source |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#230 Claude Fable 5.1
low- Kosten
- $0.126
- Zeit
- 28.5s
- Token
- 2,652 tok
#235 IBM: Granite 4.2 8B
medium
Provider returned error
- Kosten
- $0.000
- Zeit
- 0.2s
- Token
- 0 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Agentenaufgaben | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 2.8 | 1.6 | 33.3% | 1 | 34.77s | 74,534 | 1,076 | 622 | |
| Granite 4.2 8B | 10.0 | 10.0 | 100.0% | 0 | 149.50s | 206,799 | 9,509 | 21,308 |
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 6.5 | 10.0 | 50.0% | 0 | 4.54s | 858 | 666 | 0 | |
| Granite 4.2 8B | 8.4 | 10.0 | 75.0% | 0 | 10.34s | 777 | 1,452 | 889 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 3.4 | 10.0 | 0.0% | 0 | 6.75s | 10,608 | 1,753 | 0 | |
| Granite 4.2 8B | 5.5 | 10.0 | 33.3% | 0 | 12.09s | 8,439 | 2,445 | 3,900 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 10.0 | 10.0 | 100.0% | 0 | 29.40s | 97,043 | 4,733 | 3,850 | |
| Granite 4.2 8B | 3.0 | 10.0 | 0.0% | 0 | 291.12s | 24,807 | 1,902 | 6,258 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 10.0 | 10.0 | 100.0% | 0 | 4.71s | 10,515 | 312 | 0 | |
| Granite 4.2 8B | 6.5 | 10.0 | 50.0% | 0 | 1.43s | 7,683 | 270 | 75 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 4.1 | 4.4 | 44.5% | 2 | 19.30s | 990 | 61 | 8,940 | |
| Granite 4.2 8B | 5.3 | 10.0 | 33.3% | 0 | 13.96s | 876 | 154 | 290 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 10.0 | 10.0 | 100.0% | 0 | 5.62s | 714 | 325 | 0 | |
| Granite 4.2 8B | 4.0 | 10.0 | 0.0% | 0 | 605ms | 561 | 102 | 24 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 6.5 | 10.0 | 50.0% | 0 | 5.24s | 921 | 278 | 0 | |
| Granite 4.2 8B | 3.8 | 6.0 | 33.3% | 1 | 36.86s | 636 | 127 | 425 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 7.7 | 10.0 | 66.7% | 0 | 4.78s | 912 | 452 | 0 | |
| Granite 4.2 8B | 3.1 | 10.0 | 0.0% | 0 | 75.99s | 469 | 206 | 56 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 10.0 | 10.0 | 100.0% | 0 | 13.22s | 11,757 | 354 | 0 | |
| Granite 4.2 8B | 10.0 | 10.0 | 100.0% | 0 | 2.28s | 8,412 | 359 | 214 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 3.0 | 10.0 | 0.0% | 0 | 19.18s | 264 | 21 | 2,630 | |
| Granite 4.2 8B | 3.0 | 10.0 | 0.0% | 0 | 2.24s | 249 | 41 | 141 |
Schnellvergleich
Vergleichspaar wechseln
Granite 4.2 8BmediumvsKAT-Coder-Pro V2.5noneClaude Fable 5.1lowvsGemini 3.1 Flash Lite PreviewnoneGranite 4.2 8BmediumvsQwen3.5 Plus 2026-04-20noneGranite 4.2 8BmediumvsInklingnoneKostenlos verfügbarClaude Fable 5.1lowvsDeepSeek V4 Flash 0731noneClaude Fable 5.1lowvsKAT-Coder-Pro V2.5mediumGemini 3.5 FlashnonevsGranite 4.2 8BmediumClaude Fable 5.1lowvsGemini 3.5 FlashnoneClaude Fable 5.1lowvsSpace Bunny AlphaxhighClaude Fable 5.1lowvsTrinity Large ThinkingmediumClaude Fable 5.1lowvsInklingnoneKostenlos verfügbarClaude Fable 5.1lowvsQwen3.5 Plus 2026-04-20none