नेविगेशन
AI BENCHY
Advertise here

Claude Fable 5.1 (high) vs GPT-6 Astra (medium)

GPT-6 Astra (medium) average score में आगे है: 9.4 vs 9.0. GPT-6 Astra (medium) की benchmark लागत कम है: $1.774 vs $3.364. GPT-6 Astra (medium) तेज है: 8.08s vs 13.59s, pass rates 89.4% vs 90.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-04

रैंक
#25
कुल आउटपुट टोकन
40,071
प्रतिक्रिया समय (औसत)
13.59s
कुल लागत
$3.364
रैंक
#14
कुल आउटपुट टोकन
19,627
प्रतिक्रिया समय (औसत)
8.08s
कुल लागत
$1.774
अनुशंसित मॉडल GPT-6 Astra (medium)

It has the best score here (9.4), while costing about 1.9x less than Claude Fable 5.1 (high).

विस्तृत तुलना

मेट्रिक Claude Fable 5.1 Claude Fable 5.1 high रिलीज़: 2026-09-02 GPT-6 Astra GPT-6 Astra medium रिलीज़: 2026-09-04
स्कोर 9.0 9.4
रैंक #25 #14
विश्वसनीयता 10.0 9.9
संगति 9.6 9.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 89.4% 90.9%
अस्थिर टेस्ट 1 2
कुल रन 66 66
प्रति परिणाम लागत 17.701 9.337
कुल लागत $3.364 $1.774
इनपुट कीमत $10.000 / 1M $10.000 / 1M
आउटपुट कीमत $50.000 / 1M $50.000 / 1M
कुल इनपुट टोकन 135,958 79,264
आउटपुट टोकन 7,930 4,789
रीजनिंग टोकन 32,141 14,838
प्रतिक्रिया समय (औसत) 13.59s 8.08s
प्रतिक्रिया समय (अधिकतम) 40.17s 73.48s
प्रतिक्रिया समय (कुल) 298.90s 177.70s
पैरामीटर ~9.5T कुल (~878B सक्रिय) ~2T कुल (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#25 Claude Fable 5.1

high
लागत
$0.384
समय
102.5s
टोकन
7,824 tok

#14 GPT-6 Astra

medium
लागत
$0.231
समय
81.0s
टोकन
4,708 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Fable 5.1 8.4 7.4 88.9% 1 13.91s 10,608 520 6,503
GPT-6 Astra 10.0 10.0 100.0% 0 4.95s 7,302 394 1,673

त्वरित तुलना

तुलना जोड़ी बदलें