नेविगेशन
Advertise here

Claude Fable 5.1 (medium) vs Grok 4.7 (low)

Grok 4.7 (low) average score में आगे है: 7.4 vs 7.3. Grok 4.7 (low) की benchmark लागत कम है: $2.263 vs $3.197. Claude Fable 5.1 (medium) तेज है: 11.87s vs 63.19s, pass rates 78.3% vs 73.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#133
कुल आउटपुट टोकन
32,506
प्रतिक्रिया समय (औसत)
11.87s
कुल लागत
$3.197
रैंक
#127
कुल आउटपुट टोकन
255,329
प्रतिक्रिया समय (औसत)
63.19s
कुल लागत
$2.263
अनुशंसित मॉडल Claude Fable 5.1 (medium)

Its score stays close to the best score here (7.3 vs 7.4), while responding about 5.3x faster than Grok 4.7 (low).

विस्तृत तुलना

मेट्रिक Claude Fable 5.1 Claude Fable 5.1 medium रिलीज़: 2026-09-02 Grok 4.7 Grok 4.7 low रिलीज़: 2026-09-21
स्कोर 7.3 7.4
रैंक #133 #127
विश्वसनीयता 10.0 10.0
संगति 7.9 8.3
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 78.3% 73.9%
अस्थिर टेस्ट 6 5
कुल रन 69 69
प्रति परिणाम लागत 21.312 13.804
कुल लागत $3.197 $2.263
इनपुट कीमत $10.000 / 1M $2.000 / 1M
आउटपुट कीमत $50.000 / 1M $6.000 / 1M
कुल इनपुट टोकन 157,142 365,119
आउटपुट टोकन 8,149 8,118
रीजनिंग टोकन 24,357 247,211
प्रतिक्रिया समय (औसत) 11.87s 63.19s
प्रतिक्रिया समय (अधिकतम) 36.59s 389.63s
प्रतिक्रिया समय (कुल) 272.91s 1453.28s
पैरामीटर ~9.5T कुल (~878B सक्रिय) ~1.7T कुल (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#133 Claude Fable 5.1

medium
लागत
$0.244
समय
65.9s
टोकन
5,025 tok

#127 SpaceXAI: Grok 4.7

low
लागत
$0.007
समय
15.2s
टोकन
1,537 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Fable 5.1 7.0 5.0 77.8% 2 10.99s 10,608 525 4,376
Grok 4.7 8.4 7.4 88.9% 1 189.08s 9,579 346 99,053

त्वरित तुलना

तुलना जोड़ी बदलें