नेविगेशन
Advertise here

Claude Fable 5.1 (high) vs Grok 4.6 (medium)

Claude Fable 5.1 (high) average score में आगे है: 7.9 vs 7.8. Grok 4.6 (medium) की benchmark लागत कम है: $2.270 vs $3.471. Claude Fable 5.1 (high) तेज है: 13.30s vs 74.77s, pass rates 85.5% vs 78.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#98
कुल आउटपुट टोकन
40,466
प्रतिक्रिया समय (औसत)
13.30s
कुल लागत
$3.471
रैंक
#107
कुल आउटपुट टोकन
266,197
प्रतिक्रिया समय (औसत)
74.77s
कुल लागत
$2.270
अनुशंसित मॉडल Claude Fable 5.1 (high)

It has the best score here (7.9), while responding about 5.6x faster than Grok 4.6 (medium).

विस्तृत तुलना

मेट्रिक Claude Fable 5.1 Claude Fable 5.1 high रिलीज़: 2026-09-02 Grok 4.6 Grok 4.6 medium रिलीज़: 2026-08-12
स्कोर 7.9 7.8
रैंक #98 #107
विश्वसनीयता 10.0 10.0
संगति 9.7 8.7
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 85.5% 78.3%
अस्थिर टेस्ट 1 4
कुल रन 69 69
प्रति परिणाम लागत 18.264 14.187
कुल लागत $3.471 $2.270
इनपुट कीमत $10.000 / 1M $2.000 / 1M
आउटपुट कीमत $50.000 / 1M $6.000 / 1M
कुल इनपुट टोकन 144,676 336,351
आउटपुट टोकन 8,184 6,180
रीजनिंग टोकन 32,282 260,017
प्रतिक्रिया समय (औसत) 13.30s 74.77s
प्रतिक्रिया समय (अधिकतम) 40.17s 514.35s
प्रतिक्रिया समय (कुल) 305.83s 1719.73s
पैरामीटर ~9.5T कुल (~878B सक्रिय) ~1.7T कुल (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#98 Claude Fable 5.1

high
लागत
$0.384
समय
102.5s
टोकन
7,824 tok

#107 SpaceXAI: Grok 4.6

medium
लागत
$0.028
समय
72.1s
टोकन
4,771 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Fable 5.1 8.4 7.4 88.9% 1 13.91s 10,608 520 6,503
Grok 4.6 8.2 7.2 88.9% 1 120.05s 9,579 351 64,226

त्वरित तुलना

तुलना जोड़ी बदलें