नेविगेशन
AI BENCHY
Advertise here

Claude Fable 5.1 (low) vs Grok 4.3 (medium)

Grok 4.3 (medium) average score में आगे है: 7.0 vs 6.9. Grok 4.3 (medium) की benchmark लागत कम है: $0.741 vs $2.565. Claude Fable 5.1 (low) तेज है: 10.33s vs 44.21s, pass rates 56.1% vs 66.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-02

रैंक
#130
कुल आउटपुट टोकन
24,375
प्रतिक्रिया समय (औसत)
10.33s
कुल लागत
$2.565
रैंक
#120
कुल आउटपुट टोकन
225,904
प्रतिक्रिया समय (औसत)
44.21s
कुल लागत
$0.741
अनुशंसित मॉडल Grok 4.3 (medium)

It has the best score here (7.0), while costing about 3.5x less than Claude Fable 5.1 (low).

विस्तृत तुलना

मेट्रिक Claude Fable 5.1 Claude Fable 5.1 low रिलीज़: 2026-09-02 Grok 4.3 Grok 4.3 medium रिलीज़: 2026-05-01
स्कोर 6.9 7.0
रैंक #130 #120
विश्वसनीयता 10.0 10.0
संगति 9.2 8.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 56.1% 66.7%
अस्थिर टेस्ट 2 5
कुल रन 66 66
प्रति परिणाम लागत 23.315 6.168
कुल लागत $2.565 $0.741
इनपुट कीमत $10.000 / 1M $1.250 / 1M
आउटपुट कीमत $50.000 / 1M $2.500 / 1M
कुल इनपुट टोकन 134,582 140,244
आउटपुट टोकन 8,955 13,739
रीजनिंग टोकन 15,420 212,165
प्रतिक्रिया समय (औसत) 10.33s 44.21s
प्रतिक्रिया समय (अधिकतम) 33.10s 216.69s
प्रतिक्रिया समय (कुल) 227.37s 972.64s
पैरामीटर ~9.5T कुल (~878B सक्रिय) ~1.5T कुल (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#130 Claude Fable 5.1

low
लागत
$0.126
समय
28.5s
टोकन
2,652 tok

#120 SpaceXAI: Grok 4.3

medium
लागत
$0.009
समय
19.0s
टोकन
3,661 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Fable 5.1 3.4 10.0 0.0% 0 6.75s 10,608 1,753 0
Grok 4.3 5.9 7.7 44.4% 1 41.23s 8,340 1,028 31,226

त्वरित तुलना

तुलना जोड़ी बदलें