- रैंक
- #48
- कुल आउटपुट टोकन
- 31,152
- प्रतिक्रिया समय (औसत)
- 11.67s
- कुल लागत
- $2.909
Claude Fable 5.1 (medium) vs Qwen3.8 2.4T A95B (low)
Claude Fable 5.1 (medium) average score में आगे है: 8.3 vs 8.1. Qwen3.8 2.4T A95B (low) की benchmark लागत कम है: $2.672 vs $2.909. Claude Fable 5.1 (medium) तेज है: 11.67s vs 118.97s, pass rates 81.8% vs 72.7%.
- रैंक
- #51
- कुल आउटपुट टोकन
- 495,541
- प्रतिक्रिया समय (औसत)
- 118.97s
- कुल लागत
- $2.672
अनुशंसित मॉडल
Claude Fable 5.1 (medium)
It has the best score here (8.3), while responding about 10.2x faster than Qwen3.8 2.4T A95B (low).
विस्तृत तुलना
| मेट्रिक | Claude Fable 5.1 Claude Fable 5.1 medium | Qwen3.8 2.4T A95B Qwen3.8 2.4T A95B low |
|---|---|---|
| स्कोर | 8.3 | 8.1 |
| रैंक | #48 | #51 |
| विश्वसनीयता | 10.0 | 9.4 |
| संगति | 7.8 | 9.2 |
| प्रयास | 66/66 | 66/66 |
| सही परीक्षण | ||
| प्रति प्रयास पास दर | 81.8% | 72.7% |
| अस्थिर टेस्ट | 6 | 2 |
| कुल रन | 66 | 66 |
| प्रति परिणाम लागत | 19.392 | 17.812 |
| कुल लागत | $2.909 | $2.672 |
| इनपुट कीमत | $10.000 / 1M | $2.000 / 1M |
| आउटपुट कीमत | $50.000 / 1M | $6.000 / 1M |
| कुल इनपुट टोकन | 135,112 | 113,279 |
| आउटपुट टोकन | 7,594 | 121,045 |
| रीजनिंग टोकन | 23,558 | 374,496 |
| प्रतिक्रिया समय (औसत) | 11.67s | 118.97s |
| प्रतिक्रिया समय (अधिकतम) | 36.59s | 534.21s |
| प्रतिक्रिया समय (कुल) | 256.73s | 2617.41s |
| पैरामीटर | ~9.5T कुल (~878B सक्रिय) | 2.4T कुल (95B सक्रिय) |
| उपलब्धता | बंद स्रोत | वेट उपलब्ध |
मॉडल जनरेशन शोकेस
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#48 Claude Fable 5.1
medium- लागत
- $0.244
- समय
- 65.9s
- टोकन
- 5,025 tok
#51 Qwen3.8 2.4T A95B
low- लागत
- $0.100
- समय
- 193.2s
- टोकन
- 16,767 tok
स्कोर के अनुसार शीर्ष मॉडल
स्कोर बनाम कुल लागत
प्रतिक्रिया समय (औसत)
स्कोर vs प्रतिक्रिया समय (औसत)
कुल आउटपुट टोकन
स्कोर vs कुल आउटपुट टोकन
श्रेणी विवरण
| एंटी-एआई ट्रिक्स | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 8.2 | 7.9 | 83.3% | 1 | 5.18s | 858 | 485 | 334 | |
| Qwen3.8 2.4T A95B | 10.0 | 10.0 | 100.0% | 0 | 22.04s | 1,104 | 397 | 4,814 |
| कोडिंग | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 7.0 | 5.0 | 77.8% | 2 | 10.99s | 10,608 | 525 | 4,376 | |
| Qwen3.8 2.4T A95B | 7.8 | 9.3 | 66.7% | 0 | 172.53s | 6,716 | 21,405 | 57,399 |
| संयुक्त | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 10.0 | 10.0 | 100.0% | 0 | 32.59s | 97,573 | 4,993 | 4,831 | |
| Qwen3.8 2.4T A95B | 8.2 | 6.9 | 66.7% | 1 | 231.85s | 85,267 | 8,008 | 50,681 |
| डेटा पार्सिंग और निष्कर्षण | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 10.0 | 10.0 | 100.0% | 0 | 4.47s | 10,515 | 312 | 0 | |
| Qwen3.8 2.4T A95B | 10.0 | 10.0 | 100.0% | 0 | 22.27s | 7,956 | 839 | 2,445 |
| डोमेन-विशिष्ट | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 7.7 | 10.0 | 66.7% | 0 | 19.29s | 990 | 63 | 9,185 | |
| Qwen3.8 2.4T A95B | 3.2 | 9.3 | 0.0% | 0 | 287.65s | 1,008 | 16,133 | 156,114 |
| Samanya Buddhimatta | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 10.0 | 10.0 | 100.0% | 0 | 5.14s | 714 | 280 | 0 | |
| Qwen3.8 2.4T A95B | 6.1 | 3.1 | 66.7% | 1 | 22.97s | 606 | 44 | 1,497 |
| निर्देश पालन | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 7.3 | 5.8 | 83.3% | 1 | 5.77s | 921 | 146 | 183 | |
| Qwen3.8 2.4T A95B | 9.8 | 10.0 | 100.0% | 0 | 19.54s | 903 | 263 | 1,480 |
| पहेली समाधान | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 7.6 | 7.2 | 77.8% | 1 | 5.70s | 912 | 422 | 352 | |
| Qwen3.8 2.4T A95B | 10.0 | 10.0 | 100.0% | 0 | 43.37s | 1,026 | 1,154 | 25,563 |
| टूल कॉलिंग | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 10.0 | 10.0 | 100.0% | 0 | 12.99s | 11,757 | 354 | 0 | |
| Qwen3.8 2.4T A95B | 10.0 | 10.0 | 100.0% | 0 | 25.88s | 8,481 | 302 | 975 |
| सामान्य ज्ञान | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 2.8 | 1.6 | 33.3% | 1 | 24.32s | 264 | 14 | 4,297 | |
| Qwen3.8 2.4T A95B | 3.0 | 10.0 | 0.0% | 0 | 422.46s | 212 | 72,500 | 73,528 |
त्वरित तुलना
तुलना जोड़ी बदलें
GPT-5 MinimediumvsQwen3.8 2.4T A95BlowMuse Glimmer 30BxhighvsQwen3.8 2.4T A95BlowClaude Fable 5.1mediumvsMuse Spark 1.1lowQwen3.8 2.4T A95BlowvsInklinghighMuse Spark 1.1highvsQwen3.8 2.4T A95BlowDeepSeek V4 Flash 0731highvsQwen3.8 2.4T A95BlowClaude Sonnet 5mediumvsQwen3.8 2.4T A95BlowQwen3.8 2.4T A95BlowvsGLM 5.2highClaude Fable 5.1mediumvsInkling SmallhighClaude Fable 5.1mediumvsQwen3.8 27BhighQwen3.8 2.4T A95BlowvsInklingmediumClaude Fable 5.1mediumvsGrok 4.5low