- Rang
- #18
- Gesamte Ausgabe-Token
- 40,071
- Antwortzeit (Durchschnitt)
- 13.59s
- Gesamtkosten
- $3.364
Claude Fable 5.1 (high) vs Gemini 3.1 Pro Preview (medium)
Gemini 3.1 Pro Preview (medium) führt beim Durchschnittsscore mit 9.2 vs 9.0. Gemini 3.1 Pro Preview (medium) hat die niedrigeren Benchmark-Kosten mit $1.352 vs $3.364. Claude Fable 5.1 (high) ist schneller mit 13.59s vs 20.62s, mit Erfolgsraten von 89.4% vs 90.9%.
- Rang
- #12
- Gesamte Ausgabe-Token
- 97,238
- Antwortzeit (Durchschnitt)
- 20.62s
- Gesamtkosten
- $1.352
Empfohlenes Modell
Gemini 3.1 Pro Preview (medium)
Es hat hier die beste Punktzahl (9.2) und kostet etwa 2.5x weniger als Claude Fable 5.1 (high).
Detaillierter Vergleich
| Metrik | Claude Fable 5.1 Claude Fable 5.1 high | Gemini 3.1 Pro Preview Gemini 3.1 Pro Preview medium |
|---|---|---|
| Punktzahl | 9.0 | 9.2 |
| Rang | #18 | #12 |
| Zuverlässigkeit | 10.0 | 10.0 |
| Konsistenz | 9.6 | 10.0 |
| Versuche | 66/66 | 66/66 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 89.4% | 90.9% |
| Instabile Tests | 1 | 0 |
| Gesamtläufe | 66 | 66 |
| Kosten pro Ergebnis | 17.701 | 6.758 |
| Gesamtkosten | $3.364 | $1.352 |
| Eingabepreis | $10.000 / 1M | $2.000 / 1M |
| Ausgabepreis | $50.000 / 1M | $12.000 / 1M |
| Gesamte Eingabe-Token | 135,958 | 92,296 |
| Ausgabe-Token | 7,930 | 5,232 |
| Denk-Token | 32,141 | 92,006 |
| Antwortzeit (Durchschnitt) | 13.59s | 20.62s |
| Antwortzeit (Maximum) | 40.17s | 88.68s |
| Antwortzeit (Gesamt) | 298.90s | 329.94s |
| Parameter | ~9.5T insgesamt (~878B aktiv) | ~1.2T insgesamt (~20B aktiv) |
| Verfügbarkeit | Geschlossen | Geschlossen |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#18 Claude Fable 5.1
high- Kosten
- $0.384
- Zeit
- 102.5s
- Token
- 7,824 tok
#12 Gemini 3.1 Pro Preview
medium- Kosten
- $0.115
- Zeit
- 87.2s
- Token
- 9,629 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 10.0 | 10.0 | 100.0% | 0 | 5.90s | 858 | 287 | 790 | |
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 7.90s | 498 | 112 | 3,218 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 8.4 | 7.4 | 88.9% | 1 | 13.91s | 10,608 | 520 | 6,503 | |
| Gemini 3.1 Pro Preview | 7.9 | 9.9 | 66.7% | 0 | 40.17s | 8,124 | 435 | 41,247 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 10.0 | 10.0 | 100.0% | 0 | 34.59s | 98,419 | 5,484 | 5,373 | |
| Gemini 3.1 Pro Preview | 9.8 | 10.0 | 100.0% | 0 | 40.39s | 67,910 | 3,687 | 23,111 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 10.0 | 10.0 | 100.0% | 0 | 6.30s | 10,515 | 312 | 403 | |
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 7.72s | 7,265 | 279 | 3,904 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 7.7 | 10.0 | 66.7% | 0 | 24.34s | 990 | 63 | 12,436 | |
| Gemini 3.1 Pro Preview | 7.7 | 10.0 | 66.7% | 0 | 20.29s | 644 | 18 | 11,704 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 10.0 | 10.0 | 100.0% | 0 | 5.40s | 714 | 291 | 0 | |
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 11.77s | 490 | 108 | 1,179 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 10.0 | 10.0 | 100.0% | 0 | 5.60s | 921 | 97 | 263 | |
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 9.56s | 621 | 72 | 2,236 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 10.0 | 10.0 | 100.0% | 0 | 6.11s | 912 | 506 | 558 | |
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 6.90s | 570 | 235 | 3,128 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 10.0 | 10.0 | 100.0% | 0 | 13.30s | 11,757 | 354 | 118 | |
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 23.15s | 6,018 | 274 | 982 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 3.0 | 10.0 | 0.0% | 0 | 30.58s | 264 | 16 | 5,697 | |
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 6.27s | 156 | 12 | 1,297 |
Schnellvergleich
Vergleichspaar wechseln
Claude Fable 5.1highvsGemini 3.5 FlashmediumClaude Fable 5.1highvsGPT-5.5mediumClaude Fable 5.1highvsQwen3.8 MaxmediumClaude Fable 5.1highvsQwen3.7 MaxmediumClaude Opus 5highvsGemini 3.1 Pro PreviewmediumClaude Fable 5.1highvsSeed 2.1 TurbolowGemini 3.1 Pro PreviewmediumvsGrok 4.6highGemini 3.1 Pro PreviewmediumvsGPT-5.5lowClaude Fable 5.1highvsGPT-5.3-CodexmediumGemini 3.1 Pro PreviewmediumvsGPT-5.6 SolhighSeed 2.1 TurbolowvsGemini 3.1 Pro PreviewmediumClaude Fable 5.1highvsGemini 3.7 Flashlow