- Peringkat
- #133
- Total token output
- 32,506
- Waktu respons (rata-rata)
- 11.87s
- Total Biaya
- $3.197
Claude Fable 5.1 (medium) vs Qwen3.5-27B
Claude Fable 5.1 (medium) unggul dalam skor rata-rata dengan 7.3 vs 7.2. Qwen3.5-27B memiliki biaya benchmark lebih rendah di $0.116 vs $3.197. Qwen3.5-27B lebih cepat di 9.98s vs 11.87s, dengan tingkat keberhasilan 78.3% vs 47.8%.
Model yang Dibandingkan
- Peringkat
- #139
- Total token output
- 36,422
- Waktu respons (rata-rata)
- 9.98s
- Total Biaya
- $0.116
Model yang direkomendasikan
Qwen3.5-27B
Its score stays close to the best score here (7.2 vs 7.3), while costing about 27.7x less than Claude Fable 5.1 (medium).
Perbandingan terperinci
| Metrik | Claude Fable 5.1 Claude Fable 5.1 medium | Qwen3.5-27B Qwen3.5-27B none |
|---|---|---|
| Skor | 7.3 | 7.2 |
| Peringkat | #133 | #139 |
| Keandalan | 10.0 | 10.0 |
| Konsistensi | 7.9 | 9.4 |
| Percobaan | 69/69 | 69/69 |
| Tes benar | ||
| Tingkat lulus per percobaan | 78.3% | 47.8% |
| Tes tidak stabil | 6 | 2 |
| Total Run | 69 | 69 |
| Biaya per hasil | 21.312 | 1.153 |
| Total Biaya | $3.197 | $0.116 |
| Harga input | $10.000 / 1M | $0.195 / 1M |
| Harga output | $50.000 / 1M | $1.560 / 1M |
| Total token input | 157,142 | 283,977 |
| Token output | 8,149 | 36,422 |
| Token penalaran | 24,357 | 0 |
| Waktu respons (rata-rata) | 11.87s | 9.98s |
| Waktu respons (maks) | 36.59s | 124.53s |
| Waktu respons (total) | 272.91s | 229.52s |
| Parameter | ~9.5T total (~878B aktif) | 27B |
| Ketersediaan | Tertutup | Sumber terbuka |
Showcase generasi model
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#133 Claude Fable 5.1
medium- Biaya
- $0.244
- Waktu
- 65.9s
- Token
- 5,025 tok
#139 Qwen3.5-27B
none- Biaya
- $0.007
- Waktu
- 42.9s
- Token
- 4,273 tok
Model teratas berdasarkan skor
Skor vs Total Biaya
Waktu respons (rata-rata)
Skor vs Waktu respons (rata-rata)
Total token output
Skor vs Total token output
Rincian Kategori
| Tugas agen | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 3.0 | 10.0 | 0.0% | 0 | 16.18s | 22,030 | 555 | 799 | |
| Qwen3.5-27B | 10.0 | 10.0 | 100.0% | 0 | 124.53s | 181,652 | 12,099 | 0 |
| Trik anti-AI | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 8.2 | 7.9 | 83.3% | 1 | 5.18s | 858 | 485 | 334 | |
| Qwen3.5-27B | 4.8 | 10.0 | 25.0% | 0 | 788ms | 696 | 267 | 0 |
| Pemrograman | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 7.0 | 5.0 | 77.8% | 2 | 10.99s | 10,608 | 525 | 4,376 | |
| Qwen3.5-27B | 5.8 | 10.0 | 33.3% | 0 | 1.80s | 7,913 | 415 | 0 |
| Gabungan | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 10.0 | 10.0 | 100.0% | 0 | 32.59s | 97,573 | 4,993 | 4,831 | |
| Qwen3.5-27B | 6.4 | 5.8 | 66.7% | 1 | 39.43s | 74,756 | 22,190 | 0 |
| Parsing dan ekstraksi data | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 10.0 | 10.0 | 100.0% | 0 | 4.47s | 10,515 | 312 | 0 | |
| Qwen3.5-27B | 10.0 | 10.0 | 100.0% | 0 | 1.43s | 7,794 | 243 | 0 |
| Spesifik domain | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 7.7 | 10.0 | 66.7% | 0 | 19.29s | 990 | 63 | 9,185 | |
| Qwen3.5-27B | 5.3 | 10.0 | 33.3% | 0 | 634ms | 798 | 17 | 0 |
| Kecerdasan umum | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 10.0 | 10.0 | 100.0% | 0 | 5.14s | 714 | 280 | 0 | |
| Qwen3.5-27B | 5.0 | 10.0 | 0.0% | 0 | 2.51s | 522 | 126 | 0 |
| Kepatuhan instruksi | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 7.3 | 5.8 | 83.3% | 1 | 5.77s | 921 | 146 | 183 | |
| Qwen3.5-27B | 6.3 | 10.0 | 50.0% | 0 | 1.03s | 711 | 69 | 0 |
| Pemecahan teka-teki | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 7.6 | 7.2 | 77.8% | 1 | 5.70s | 912 | 422 | 352 | |
| Qwen3.5-27B | 6.7 | 7.9 | 55.6% | 1 | 1.38s | 714 | 683 | 0 |
| Pemanggilan alat | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 10.0 | 10.0 | 100.0% | 0 | 12.99s | 11,757 | 354 | 0 | |
| Qwen3.5-27B | 10.0 | 10.0 | 100.0% | 0 | 3.54s | 8,211 | 303 | 0 |
| Pengetahuan umum | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 2.8 | 1.6 | 33.3% | 1 | 24.32s | 264 | 14 | 4,297 | |
| Qwen3.5-27B | 3.0 | 10.0 | 0.0% | 0 | 599ms | 210 | 10 | 0 |
Perbandingan Cepat
Ganti Pasangan Perbandingan
Claude Fable 5.1mediumvsGLM 5.3 FlashhighClaude Fable 5.1mediumvsLongCat 2.0highGemini 3.5 Flash LitemediumvsQwen3.5-27BnoneGemini 3.8 FlashlowvsQwen3.5-27BnoneLongCat 2.0highvsQwen3.5-27BnoneGemini 2.5 FlashmediumvsQwen3.5-27BnoneClaude Opus 4.8lowvsQwen3.5-27BnoneQwen3.5-27BnonevsGrok 4.7mediumLongCat 2.0mediumvsQwen3.5-27BnoneClaude Fable 5.1mediumvsDeepSeek V4 Pro 0423noneQwen3.5-27BnonevsGLM 5mediumQwen3.5-27BnonevsStep 3.7 Flashlow