नेविगेशन
Advertise here

Claude Fable 5.1 (medium) vs GLM 5.3 Flash (high)

average score लगभग बराबर है: 7.3 vs 7.3. GLM 5.3 Flash (high) की benchmark लागत कम है: $0.084 vs $3.197. Claude Fable 5.1 (medium) तेज है: 11.87s vs 29.11s, pass rates 78.3% vs 66.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#133
कुल आउटपुट टोकन
32,506
प्रतिक्रिया समय (औसत)
11.87s
कुल लागत
$3.197
रैंक
#132
कुल आउटपुट टोकन
99,340
प्रतिक्रिया समय (औसत)
29.11s
कुल लागत
$0.084
अनुशंसित मॉडल GLM 5.3 Flash (high)

It has the best score here (7.3), while costing about 38.3x less than Claude Fable 5.1 (medium).

विस्तृत तुलना

मेट्रिक Claude Fable 5.1 Claude Fable 5.1 medium रिलीज़: 2026-09-02 GLM 5.3 Flash GLM 5.3 Flash high रिलीज़: 2026-08-26
स्कोर 7.3 7.3
रैंक #133 #132
विश्वसनीयता 10.0 10.0
संगति 7.9 8.6
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 78.3% 66.7%
अस्थिर टेस्ट 6 4
कुल रन 69 69
प्रति परिणाम लागत 21.312 0.426
कुल लागत $3.197 $0.084
इनपुट कीमत $10.000 / 1M $0.150 / 1M
आउटपुट कीमत $50.000 / 1M $0.500 / 1M
कुल इनपुट टोकन 157,142 225,013
आउटपुट टोकन 8,149 12,197
रीजनिंग टोकन 24,357 87,143
प्रतिक्रिया समय (औसत) 11.87s 29.11s
प्रतिक्रिया समय (अधिकतम) 36.59s 163.41s
प्रतिक्रिया समय (कुल) 272.91s 669.54s
पैरामीटर ~9.5T कुल (~878B सक्रिय) 320B कुल (18B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#133 Claude Fable 5.1

medium
लागत
$0.244
समय
65.9s
टोकन
5,025 tok

#132 GLM 5.3 Flash

high
लागत
$0.003
समय
186.7s
टोकन
10,486 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Fable 5.1 7.0 5.0 77.8% 2 10.99s 10,608 525 4,376
GLM 5.3 Flash 8.2 7.2 88.9% 1 19.62s 7,317 373 9,973

त्वरित तुलना

तुलना जोड़ी बदलें