नेविगेशन
AI BENCHY
Advertise here

Claude Fable 5.1 (low) vs KAT-Coder-Pro V2.5 (medium)

average score लगभग बराबर है: 6.9 vs 6.9. KAT-Coder-Pro V2.5 (medium) की benchmark लागत कम है: $0.478 vs $2.565. Claude Fable 5.1 (low) तेज है: 10.33s vs 24.87s, pass rates 56.1% vs 65.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-02

रैंक
#130
कुल आउटपुट टोकन
24,375
प्रतिक्रिया समय (औसत)
10.33s
कुल लागत
$2.565
रैंक
#129
कुल आउटपुट टोकन
139,375
प्रतिक्रिया समय (औसत)
24.87s
कुल लागत
$0.478
अनुशंसित मॉडल KAT-Coder-Pro V2.5 (medium)

It has the best score here (6.9), while costing about 5.4x less than Claude Fable 5.1 (low).

विस्तृत तुलना

मेट्रिक Claude Fable 5.1 Claude Fable 5.1 low रिलीज़: 2026-09-02 KAT-Coder-Pro V2.5 KAT-Coder-Pro V2.5 medium रिलीज़: 2026-07-14
स्कोर 6.9 6.9
रैंक #130 #129
विश्वसनीयता 10.0 10.0
संगति 9.2 7.0
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 56.1% 65.2%
अस्थिर टेस्ट 2 8
कुल रन 66 66
प्रति परिणाम लागत 23.315 4.342
कुल लागत $2.565 $0.478
इनपुट कीमत $10.000 / 1M $0.740 / 1M
आउटपुट कीमत $50.000 / 1M $2.960 / 1M
कुल इनपुट टोकन 134,582 87,916
आउटपुट टोकन 8,955 7,213
रीजनिंग टोकन 15,420 132,162
प्रतिक्रिया समय (औसत) 10.33s 24.87s
प्रतिक्रिया समय (अधिकतम) 33.10s 257.00s
प्रतिक्रिया समय (कुल) 227.37s 547.14s
पैरामीटर ~9.5T कुल (~878B सक्रिय) ~700B कुल (~72B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#130 Claude Fable 5.1

low
लागत
$0.126
समय
28.5s
टोकन
2,652 tok

#129 KAT-Coder-Pro V2.5

medium
लागत
$0.009
समय
25.6s
टोकन
2,939 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Fable 5.1 3.4 10.0 0.0% 0 6.75s 10,608 1,753 0
KAT-Coder-Pro V2.5 7.8 10.0 66.7% 0 33.10s 7,893 416 33,658

त्वरित तुलना

तुलना जोड़ी बदलें