नेविगेशन
AI BENCHY
Advertise here

Claude Fable 5 (medium) vs GPT-5.4 (medium)

Claude Fable 5 (medium) average score में आगे है: 8.6 vs 8.5. GPT-5.4 (medium) की benchmark लागत कम है: $1.560 vs $3.004. Claude Fable 5 (medium) तेज है: 15.01s vs 22.85s, pass rates 78.8% vs 77.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-02

रैंक
#40
कुल आउटपुट टोकन
42,146
प्रतिक्रिया समय (औसत)
15.01s
कुल लागत
$3.004
रैंक
#43
कुल आउटपुट टोकन
90,466
प्रतिक्रिया समय (औसत)
22.85s
कुल लागत
$1.560
अनुशंसित मॉडल GPT-5.4 (medium)

Its score stays close to the best score here (8.5 vs 8.6), while costing about 1.9x less than Claude Fable 5 (medium).

विस्तृत तुलना

मेट्रिक Claude Fable 5 Claude Fable 5 medium रिलीज़: 2026-06-10 GPT-5.4 GPT-5.4 medium रिलीज़: 2026-03-05
स्कोर 8.6 8.5
रैंक #40 #43
विश्वसनीयता 10.0 10.0
संगति 9.6 8.6
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 78.8% 77.3%
अस्थिर टेस्ट 1 4
कुल रन 66 66
प्रति परिणाम लागत 17.669 10.399
कुल लागत $3.004 $1.560
इनपुट कीमत $10.000 / 1M $2.500 / 1M
आउटपुट कीमत $50.000 / 1M $15.000 / 1M
कुल इनपुट टोकन 89,640 81,136
आउटपुट टोकन 33,092 6,155
रीजनिंग टोकन 9,054 84,311
प्रतिक्रिया समय (औसत) 15.01s 22.85s
प्रतिक्रिया समय (अधिकतम) 80.80s 100.41s
प्रतिक्रिया समय (कुल) 330.15s 502.78s
पैरामीटर ~9.5T कुल (~878B सक्रिय) ~1.5T कुल (~100B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#40 Claude Fable 5

medium
लागत
$0.606
समय
156.7s
टोकन
12,264 tok

#43 GPT-5.4

medium
लागत
$0.214
समय
199.6s
टोकन
14,349 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Fable 5 10.0 10.0 100.0% 0 15.59s 10,590 7,383 1,318
GPT-5.4 8.8 7.8 88.9% 1 44.36s 7,305 433 24,216

त्वरित तुलना

तुलना जोड़ी बदलें