नेविगेशन
AI BENCHY
Advertise here

Claude Fable 5.1 (high) vs Qwen3.8 Max (medium)

average score लगभग बराबर है: 9.0 vs 9.0. Qwen3.8 Max (medium) की benchmark लागत कम है: $0.771 vs $3.364. Claude Fable 5.1 (high) तेज है: 13.59s vs 23.34s, pass rates 89.4% vs 80.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-02

रैंक
#18
कुल आउटपुट टोकन
40,071
प्रतिक्रिया समय (औसत)
13.59s
कुल लागत
$3.364
रैंक
#21
कुल आउटपुट टोकन
92,047
प्रतिक्रिया समय (औसत)
23.34s
कुल लागत
$0.771
अनुशंसित मॉडल Qwen3.8 Max (medium)

It has the best score here (9.0), while costing about 4.4x less than Claude Fable 5.1 (high).

विस्तृत तुलना

मेट्रिक Claude Fable 5.1 Claude Fable 5.1 high रिलीज़: 2026-09-02 Qwen3.8 Max Qwen3.8 Max medium रिलीज़: 2026-08-04
स्कोर 9.0 9.0
रैंक #18 #21
विश्वसनीयता 10.0 10.0
संगति 9.6 9.7
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 89.4% 80.3%
अस्थिर टेस्ट 1 1
कुल रन 66 66
प्रति परिणाम लागत 17.701 4.532
कुल लागत $3.364 $0.771
इनपुट कीमत $10.000 / 1M $2.000 / 1M
आउटपुट कीमत $50.000 / 1M $6.000 / 1M
कुल इनपुट टोकन 135,958 109,055
आउटपुट टोकन 7,930 6,566
रीजनिंग टोकन 32,141 85,481
प्रतिक्रिया समय (औसत) 13.59s 23.34s
प्रतिक्रिया समय (अधिकतम) 40.17s 126.60s
प्रतिक्रिया समय (कुल) 298.90s 513.47s
पैरामीटर ~9.5T कुल (~878B सक्रिय) 2.4T कुल (~100B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#18 Claude Fable 5.1

high
लागत
$0.384
समय
102.5s
टोकन
7,824 tok

#21 Qwen3.8 Max

medium
लागत
$0.028
समय
71.9s
टोकन
4,750 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Fable 5.1 8.4 7.4 88.9% 1 13.91s 10,608 520 6,503
Qwen3.8 Max 10.0 10.0 100.0% 0 41.35s 7,893 430 23,804

त्वरित तुलना

तुलना जोड़ी बदलें