- Peringkat
- #64
- Total token output
- 31,152
- Waktu respons (rata-rata)
- 11.67s
- Total Biaya
- $2.909
Claude Fable 5.1 (medium) vs DeepSeek V4.1 Flash (max)
DeepSeek V4.1 Flash (max) unggul dalam skor rata-rata dengan 8.3 vs 8.3. DeepSeek V4.1 Flash (max) memiliki biaya benchmark lebih rendah di $0.537 vs $2.909. Claude Fable 5.1 (medium) lebih cepat di 11.67s vs 61.35s, dengan tingkat keberhasilan 81.8% vs 68.2%.
Model yang Dibandingkan
- Peringkat
- #62
- Total token output
- 871,126
- Waktu respons (rata-rata)
- 61.35s
- Total Biaya
- $0.537
Model yang direkomendasikan
DeepSeek V4.1 Flash (max)
It has the best score here (8.3), while costing about 5.4x less than Claude Fable 5.1 (medium).
Perbandingan terperinci
| Metrik | Claude Fable 5.1 Claude Fable 5.1 medium | DeepSeek V4.1 Flash DeepSeek V4.1 Flash max |
|---|---|---|
| Skor | 8.3 | 8.3 |
| Peringkat | #64 | #62 |
| Keandalan | 10.0 | 9.1 |
| Konsistensi | 7.8 | 9.2 |
| Percobaan | 66/66 | 66/66 |
| Tes benar | ||
| Tingkat lulus per percobaan | 81.8% | 68.2% |
| Tes tidak stabil | 6 | 2 |
| Total Run | 66 | 66 |
| Biaya per hasil | 19.392 | 3.829 |
| Total Biaya | $2.909 | $0.537 |
| Harga input | $10.000 / 1M | $0.150 / 1M |
| Harga output | $50.000 / 1M | $0.600 / 1M |
| Total token input | 135,112 | 89,024 |
| Token output | 7,594 | 5,558 |
| Token penalaran | 23,558 | 865,568 |
| Waktu respons (rata-rata) | 11.67s | 61.35s |
| Waktu respons (maks) | 36.59s | 335.08s |
| Waktu respons (total) | 256.73s | 1349.61s |
| Parameter | ~9.5T total (~878B aktif) | 748B total (16B aktif) |
| Ketersediaan | Tertutup | Sumber terbuka |
Showcase generasi model
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#64 Claude Fable 5.1
medium- Biaya
- $0.244
- Waktu
- 65.9s
- Token
- 5,025 tok
#62 DeepSeek V4.1 Flash
max- Biaya
- $0.066
- Waktu
- 211.0s
- Token
- 54,712 tok
Model teratas berdasarkan skor
Skor vs Total Biaya
Waktu respons (rata-rata)
Skor vs Waktu respons (rata-rata)
Total token output
Skor vs Total token output
Rincian Kategori
| Trik anti-AI | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 8.2 | 7.9 | 83.3% | 1 | 5.18s | 858 | 485 | 334 | |
| DeepSeek V4.1 Flash | 8.3 | 10.0 | 75.0% | 0 | 4.35s | 852 | 213 | 7,262 |
| Pemrograman | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 7.0 | 5.0 | 77.8% | 2 | 10.99s | 10,608 | 525 | 4,376 | |
| DeepSeek V4.1 Flash | 10.0 | 10.0 | 100.0% | 0 | 62.50s | 7,509 | 373 | 132,357 |
| Gabungan | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 10.0 | 10.0 | 100.0% | 0 | 32.59s | 97,573 | 4,993 | 4,831 | |
| DeepSeek V4.1 Flash | 10.0 | 10.0 | 100.0% | 0 | 160.31s | 66,677 | 4,031 | 221,091 |
| Parsing dan ekstraksi data | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 10.0 | 10.0 | 100.0% | 0 | 4.47s | 10,515 | 312 | 0 | |
| DeepSeek V4.1 Flash | 6.5 | 10.0 | 50.0% | 0 | 4.56s | 2,397 | 120 | 2,047 |
| Spesifik domain | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 7.7 | 10.0 | 66.7% | 0 | 19.29s | 990 | 63 | 9,185 | |
| DeepSeek V4.1 Flash | 3.6 | 7.2 | 22.2% | 1 | 198.41s | 909 | 27 | 384,462 |
| Kecerdasan umum | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 10.0 | 10.0 | 100.0% | 0 | 5.14s | 714 | 280 | 0 | |
| DeepSeek V4.1 Flash | 10.0 | 10.0 | 100.0% | 0 | 4.00s | 549 | 148 | 1,093 |
| Kepatuhan instruksi | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 7.3 | 5.8 | 83.3% | 1 | 5.77s | 921 | 146 | 183 | |
| DeepSeek V4.1 Flash | 10.0 | 10.0 | 100.0% | 0 | 7.64s | 783 | 63 | 2,293 |
| Pemecahan teka-teki | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 7.6 | 7.2 | 77.8% | 1 | 5.70s | 912 | 422 | 352 | |
| DeepSeek V4.1 Flash | 5.5 | 7.1 | 44.4% | 1 | 30.82s | 828 | 339 | 54,014 |
| Pemanggilan alat | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 10.0 | 10.0 | 100.0% | 0 | 12.99s | 11,757 | 354 | 0 | |
| DeepSeek V4.1 Flash | 10.0 | 10.0 | 100.0% | 0 | 9.49s | 8,259 | 228 | 693 |
| Pengetahuan umum | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 2.8 | 1.6 | 33.3% | 1 | 24.32s | 264 | 14 | 4,297 | |
| DeepSeek V4.1 Flash | 3.0 | 10.0 | 0.0% | 0 | 98.48s | 261 | 16 | 60,256 |
Perbandingan Cepat
Ganti Pasangan Perbandingan
DeepSeek V4.1 FlashmaxvsMuse Spark 1.1lowDeepSeek V4.1 FlashmaxvsInkling SmallhighClaude Fable 5.1mediumvsMuse Spark 1.1lowSeed 2.1 TurbomediumvsDeepSeek V4.1 FlashmaxDeepSeek V4.1 FlashmaxvsQwen3.8 27BhighDeepSeek V4.1 FlashmaxvsGPT-5.2mediumClaude Fable 5.1mediumvsMuse Spark 1.3lowDeepSeek V4.1 FlashmaxvsGrok 4.5lowDeepSeek V4.1 FlashmaxvsGemini 2.5 FlashmediumDeepSeek V4.1 FlashmaxvsGrok 4.6mediumClaude Fable 5.1mediumvsInkling SmallhighDeepSeek V4.1 FlashmaxvsMuse Spark 1.2low