नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Claude Fable 5.1 (medium) vs Qwen3.8 27B (high)

Qwen3.8 27B (high) average score में आगे है: 8.4 vs 8.3. Qwen3.8 27B (high) की benchmark लागत कम है: ~$0.287 vs $2.909. Claude Fable 5.1 (medium) तेज है: 11.67s vs 167.89s, pass rates 81.8% vs 77.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-02

रैंक
#48
कुल आउटपुट टोकन
31,152
प्रतिक्रिया समय (औसत)
11.67s
कुल लागत
$2.909
रैंक
#44
कुल आउटपुट टोकन
656,635
प्रतिक्रिया समय (औसत)
167.89s
कुल लागत
~$0.287
अनुशंसित मॉडल Qwen3.8 27B (high)

It has the best score here (8.4), while costing about 10.1x less than Claude Fable 5.1 (medium).

विस्तृत तुलना

मेट्रिक Claude Fable 5.1 Claude Fable 5.1 medium रिलीज़: 2026-09-02 Qwen3.8 27B Qwen3.8 27B high रिलीज़: 2026-08-14
स्कोर 8.3 8.4
रैंक #48 #44
विश्वसनीयता 10.0 9.6
संगति 7.8 9.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 81.8% 77.3%
अस्थिर टेस्ट 6 2
कुल रन 66 66
प्रति परिणाम लागत 19.392 ~1.792
कुल लागत $2.909 ~$0.287
इनपुट कीमत $10.000 / 1M लागू नहीं
आउटपुट कीमत $50.000 / 1M लागू नहीं
कुल इनपुट टोकन 135,112 100,179
आउटपुट टोकन 7,594 904
रीजनिंग टोकन 23,558 655,731
प्रतिक्रिया समय (औसत) 11.67s 167.89s
प्रतिक्रिया समय (अधिकतम) 36.59s 640.85s
प्रतिक्रिया समय (कुल) 256.73s 3693.54s
पैरामीटर ~9.5T कुल (~878B सक्रिय) 27.3B
उपलब्धता बंद स्रोत वेट उपलब्ध

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#48 Claude Fable 5.1

medium
लागत
$0.244
समय
65.9s
टोकन
5,025 tok

#44 Qwen3.8 27B

high
लागत
~$0.008
समय
270.1s
टोकन
18,963 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Fable 5.1 7.0 5.0 77.8% 2 10.99s 10,608 525 4,376
Qwen3.8 27B 8.1 7.0 88.9% 1 248.62s 8,235 346 143,335

त्वरित तुलना

तुलना जोड़ी बदलें

GPT-5.2mediumvsQwen3.8 27BhighSeed 2.1 TurbomediumvsQwen3.8 27BhighQwen3.8 27BhighvsGrok 4.5lowClaude Fable 5.1mediumvsMuse Spark 1.1lowQwen3.8 27BhighvsGrok 4.6mediumMuse Spark 1.2lowvsQwen3.8 27BhighQwen3.8 27BhighvsGrok 4.5mediumMuse Spark 1.1lowvsQwen3.8 27BhighClaude Fable 5.1mediumvsInkling SmallhighClaude Fable 5.1mediumvsGrok 4.5lowGPT-5.4mediumvsQwen3.8 27BhighGemini 2.5 FlashmediumvsQwen3.8 27Bhigh