- Rang
- #231
- Gesamte Ausgabe-Token
- 26,073
- Antwortzeit (Durchschnitt)
- 11.40s
- Gesamtkosten
- $3.395
Claude Fable 5.1 (low) vs DeepSeek V4 Flash 0731
Der Durchschnittsscore ist mit 6.2 vs 6.2 praktisch gleichauf. DeepSeek V4 Flash 0731 hat die niedrigeren Benchmark-Kosten mit $0.055 vs $3.395. Claude Fable 5.1 (low) ist schneller mit 11.40s vs 27.42s, mit Erfolgsraten von 55.1% vs 30.4%.
Verglichene Modelle
- Rang
- #229
- Gesamte Ausgabe-Token
- 39,789
- Antwortzeit (Durchschnitt)
- 27.42s
- Gesamtkosten
- $0.055
Empfohlenes Modell
Claude Fable 5.1 (low)
Es hat hier die beste Punktzahl (6.2) und antwortet etwa 2.4x schneller als DeepSeek V4 Flash 0731.
Detaillierter Vergleich
| Metrik | Claude Fable 5.1 Claude Fable 5.1 low | DeepSeek V4 Flash 0731 DeepSeek V4 Flash 0731 none |
|---|---|---|
| Punktzahl | 6.2 | 6.2 |
| Rang | #231 | #229 |
| Zuverlässigkeit | 10.0 | 10.0 |
| Konsistenz | 8.9 | 8.7 |
| Versuche | 69/69 | 69/69 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 55.1% | 30.4% |
| Instabile Tests | 3 | 4 |
| Gesamtläufe | 69 | 69 |
| Kosten pro Ergebnis | 30.862 | 0.826 |
| Gesamtkosten | $3.395 | $0.055 |
| Eingabepreis | $10.000 / 1M | $0.010 / 1M |
| Ausgabepreis | $50.000 / 1M | $1.280 / 1M |
| Gesamte Eingabe-Token | 209,116 | 349,876 |
| Ausgabe-Token | 10,031 | 39,789 |
| Denk-Token | 16,042 | 0 |
| Antwortzeit (Durchschnitt) | 11.40s | 27.42s |
| Antwortzeit (Maximum) | 34.77s | 387.15s |
| Antwortzeit (Gesamt) | 262.14s | 630.70s |
| Parameter | ~9.5T insgesamt (~878B aktiv) | 284B insgesamt (13B aktiv) |
| Verfügbarkeit | Geschlossen | Geschlossen |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#231 Claude Fable 5.1
low- Kosten
- $0.126
- Zeit
- 28.5s
- Token
- 2,652 tok
#229 DeepSeek V4 Flash 0731
none- Kosten
- $0.004
- Zeit
- 198.4s
- Token
- 14,316 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Agentenaufgaben | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 2.8 | 1.6 | 33.3% | 1 | 34.77s | 74,534 | 1,076 | 622 | |
| DeepSeek V4 Flash 0731 | 10.0 | 10.0 | 100.0% | 0 | 174.89s | 255,310 | 14,363 | 0 |
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 6.5 | 10.0 | 50.0% | 0 | 4.54s | 858 | 666 | 0 | |
| DeepSeek V4 Flash 0731 | 3.4 | 8.3 | 8.3% | 1 | 4.19s | 540 | 801 | 0 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 3.4 | 10.0 | 0.0% | 0 | 6.75s | 10,608 | 1,753 | 0 | |
| DeepSeek V4 Flash 0731 | 4.3 | 10.0 | 0.0% | 0 | 1.72s | 7,275 | 505 | 0 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 10.0 | 10.0 | 100.0% | 0 | 29.40s | 97,043 | 4,733 | 3,850 | |
| DeepSeek V4 Flash 0731 | 3.7 | 1.8 | 50.0% | 2 | 202.44s | 65,531 | 22,822 | 0 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 10.0 | 10.0 | 100.0% | 0 | 4.71s | 10,515 | 312 | 0 | |
| DeepSeek V4 Flash 0731 | 10.0 | 10.0 | 100.0% | 0 | 2.37s | 7,290 | 199 | 0 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 4.1 | 4.4 | 44.5% | 2 | 19.30s | 990 | 61 | 8,940 | |
| DeepSeek V4 Flash 0731 | 5.3 | 10.0 | 33.3% | 0 | 1.17s | 675 | 26 | 0 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 10.0 | 10.0 | 100.0% | 0 | 5.62s | 714 | 325 | 0 | |
| DeepSeek V4 Flash 0731 | 4.4 | 9.9 | 0.0% | 0 | 3.22s | 471 | 153 | 0 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 6.5 | 10.0 | 50.0% | 0 | 5.24s | 921 | 278 | 0 | |
| DeepSeek V4 Flash 0731 | 5.0 | 6.8 | 33.3% | 1 | 1.42s | 627 | 69 | 0 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 7.7 | 10.0 | 66.7% | 0 | 4.78s | 912 | 452 | 0 | |
| DeepSeek V4 Flash 0731 | 3.2 | 9.9 | 0.0% | 0 | 2.74s | 594 | 302 | 0 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 10.0 | 10.0 | 100.0% | 0 | 13.22s | 11,757 | 354 | 0 | |
| DeepSeek V4 Flash 0731 | 9.5 | 10.0 | 100.0% | 0 | 4.61s | 11,380 | 536 | 0 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 3.0 | 10.0 | 0.0% | 0 | 19.18s | 264 | 21 | 2,630 | |
| DeepSeek V4 Flash 0731 | 3.0 | 10.0 | 0.0% | 0 | 1.85s | 183 | 13 | 0 |
Schnellvergleich
Vergleichspaar wechseln
Claude Fable 5.1lowvsGemini 3.1 Flash Lite PreviewnoneDeepSeek V4 Flash 0731nonevsKAT-Coder-Pro V2.5mediumDeepSeek V4 Flash 0731nonevsSpace Bunny AlphaxhighClaude Fable 5.1lowvsKAT-Coder-Pro V2.5mediumClaude Fable 5.1lowvsSpace Bunny AlphaxhighDeepSeek V4 Flash 0731nonevsGrok 4.20mediumClaude Fable 5.1lowvsTrinity Large ThinkingmediumClaude Fable 5.1lowvsGemini 3.5 FlashnoneClaude Fable 5.1lowvsInklingnoneKostenlos verfügbarClaude Fable 5.1lowvsGrok 4.20mediumDeepSeek V4 Flash 0731nonevsSpace Bunny AlphamediumClaude Fable 5.1lowvsDeepSeek V4 Flash 0423none