- Rang
- #230
- Gesamte Ausgabe-Token
- 26,073
- Antwortzeit (Durchschnitt)
- 11.40s
- Gesamtkosten
- $3.395
Claude Fable 5.1 (low) vs DeepSeek V4 Flash 0423
DeepSeek V4 Flash 0423 führt beim Durchschnittsscore mit 6.3 vs 6.2. DeepSeek V4 Flash 0423 hat die niedrigeren Benchmark-Kosten mit $0.050 vs $3.395. Claude Fable 5.1 (low) ist schneller mit 11.40s vs 38.64s, mit Erfolgsraten von 55.1% vs 30.4%.
Verglichene Modelle
- Rang
- #223
- Gesamte Ausgabe-Token
- 115,591
- Antwortzeit (Durchschnitt)
- 38.64s
- Gesamtkosten
- $0.050
Empfohlenes Modell
Claude Fable 5.1 (low)
Die Punktzahl bleibt nah an der besten hier (6.2 vs 6.3) und es antwortet etwa 3.4x schneller als DeepSeek V4 Flash 0423.
Detaillierter Vergleich
| Metrik | Claude Fable 5.1 Claude Fable 5.1 low | DeepSeek V4 Flash 0423 DeepSeek V4 Flash 0423 none |
|---|---|---|
| Punktzahl | 6.2 | 6.3 |
| Rang | #230 | #223 |
| Zuverlässigkeit | 10.0 | 10.0 |
| Konsistenz | 8.9 | 8.6 |
| Versuche | 69/69 | 69/69 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 55.1% | 30.4% |
| Instabile Tests | 3 | 4 |
| Gesamtläufe | 69 | 69 |
| Kosten pro Ergebnis | 30.862 | 1.220 |
| Gesamtkosten | $3.395 | $0.050 |
| Eingabepreis | $10.000 / 1M | $0.079 / 1M |
| Ausgabepreis | $50.000 / 1M | $0.158 / 1M |
| Gesamte Eingabe-Token | 209,116 | 403,455 |
| Ausgabe-Token | 10,031 | 115,591 |
| Denk-Token | 16,042 | 0 |
| Antwortzeit (Durchschnitt) | 11.40s | 38.64s |
| Antwortzeit (Maximum) | 34.77s | 247.27s |
| Antwortzeit (Gesamt) | 262.14s | 888.69s |
| Parameter | ~9.5T insgesamt (~878B aktiv) | 284B insgesamt (13B aktiv) |
| Verfügbarkeit | Geschlossen | Open Source |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#230 Claude Fable 5.1
low- Kosten
- $0.126
- Zeit
- 28.5s
- Token
- 2,652 tok
#223 DeepSeek V4 Flash 0423
none- Kosten
- $0.004
- Zeit
- 157.6s
- Token
- 11,297 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Agentenaufgaben | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 2.8 | 1.6 | 33.3% | 1 | 34.77s | 74,534 | 1,076 | 622 | |
| DeepSeek V4 Flash 0423 | 10.0 | 10.0 | 100.0% | 0 | 92.87s | 163,225 | 14,865 | 0 |
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 6.5 | 10.0 | 50.0% | 0 | 4.54s | 858 | 666 | 0 | |
| DeepSeek V4 Flash 0423 | 3.0 | 10.0 | 0.0% | 0 | 20.18s | 540 | 174 | 0 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 3.4 | 10.0 | 0.0% | 0 | 6.75s | 10,608 | 1,753 | 0 | |
| DeepSeek V4 Flash 0423 | 4.2 | 7.4 | 11.1% | 1 | 17.13s | 7,279 | 9,717 | 0 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 10.0 | 10.0 | 100.0% | 0 | 29.40s | 97,043 | 4,733 | 3,850 | |
| DeepSeek V4 Flash 0423 | 4.6 | 1.8 | 66.7% | 2 | 179.61s | 214,492 | 89,681 | 0 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 10.0 | 10.0 | 100.0% | 0 | 4.71s | 10,515 | 312 | 0 | |
| DeepSeek V4 Flash 0423 | 10.0 | 10.0 | 100.0% | 0 | 23.79s | 7,290 | 195 | 0 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 4.1 | 4.4 | 44.5% | 2 | 19.30s | 990 | 61 | 8,940 | |
| DeepSeek V4 Flash 0423 | 3.0 | 10.0 | 0.0% | 0 | 15.31s | 675 | 17 | 0 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 10.0 | 10.0 | 100.0% | 0 | 5.62s | 714 | 325 | 0 | |
| DeepSeek V4 Flash 0423 | 4.2 | 9.9 | 0.0% | 0 | 23.74s | 471 | 67 | 0 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 6.5 | 10.0 | 50.0% | 0 | 5.24s | 921 | 278 | 0 | |
| DeepSeek V4 Flash 0423 | 6.5 | 10.0 | 50.0% | 0 | 17.54s | 627 | 321 | 0 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 7.7 | 10.0 | 66.7% | 0 | 4.78s | 912 | 452 | 0 | |
| DeepSeek V4 Flash 0423 | 3.1 | 7.3 | 11.1% | 1 | 23.72s | 594 | 207 | 0 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 10.0 | 10.0 | 100.0% | 0 | 13.22s | 11,757 | 354 | 0 | |
| DeepSeek V4 Flash 0423 | 10.0 | 10.0 | 100.0% | 0 | 77.93s | 8,079 | 327 | 0 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 3.0 | 10.0 | 0.0% | 0 | 19.18s | 264 | 21 | 2,630 | |
| DeepSeek V4 Flash 0423 | 3.0 | 10.0 | 0.0% | 0 | 3.07s | 183 | 20 | 0 |
Schnellvergleich
Vergleichspaar wechseln
DeepSeek V4 Flash 0423nonevsGrok 4.20mediumClaude Fable 5.1lowvsGemini 3.1 Flash Lite PreviewnoneTrinity Large ThinkinglowvsDeepSeek V4 Flash 0423noneClaude Fable 5.1lowvsDeepSeek V4 Flash 0731noneDeepSeek V4 Flash 0423nonevsSpace Bunny AlphamediumDeepSeek V4 Flash 0423nonevsSpace Bunny AlphaxhighDeepSeek V4 Flash 0423nonevsKAT-Coder-Pro V2.5mediumClaude Fable 5.1lowvsKAT-Coder-Pro V2.5mediumDeepSeek V4 Flash 0423nonevsSolar Pro 4highDeepSeek V4 Flash 0423nonevsGemini 3.1 Flash LitelowClaude Fable 5.1lowvsGemini 3.5 FlashnoneClaude Fable 5.1lowvsSpace Bunny Alphaxhigh