नेविगेशन
AI BENCHY
Advertise here

Claude Fable 5.1 (high) vs GPT-5.5 (low)

GPT-5.5 (low) average score में आगे है: 9.3 vs 9.0. GPT-5.5 (low) की benchmark लागत कम है: $1.257 vs $3.364. GPT-5.5 (low) तेज है: 10.15s vs 13.59s, pass rates 89.4% vs 86.4%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-02

रैंक
#20
कुल आउटपुट टोकन
40,071
प्रतिक्रिया समय (औसत)
13.59s
कुल लागत
$3.364
रैंक
#11
कुल आउटपुट टोकन
28,540
प्रतिक्रिया समय (औसत)
10.15s
कुल लागत
$1.257
अनुशंसित मॉडल GPT-5.5 (low)

It has the best score here (9.3), while costing about 2.7x less than Claude Fable 5.1 (high).

विस्तृत तुलना

मेट्रिक Claude Fable 5.1 Claude Fable 5.1 high रिलीज़: 2026-09-02 GPT-5.5 GPT-5.5 low रिलीज़: 2026-04-24
स्कोर 9.0 9.3
रैंक #20 #11
विश्वसनीयता 10.0 10.0
संगति 9.6 10.0
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 89.4% 86.4%
अस्थिर टेस्ट 1 0
कुल रन 66 66
प्रति परिणाम लागत 17.701 6.614
कुल लागत $3.364 $1.257
इनपुट कीमत $10.000 / 1M $5.000 / 1M
आउटपुट कीमत $50.000 / 1M $30.000 / 1M
कुल इनपुट टोकन 135,958 80,067
आउटपुट टोकन 7,930 5,378
रीजनिंग टोकन 32,141 23,162
प्रतिक्रिया समय (औसत) 13.59s 10.15s
प्रतिक्रिया समय (अधिकतम) 40.17s 56.19s
प्रतिक्रिया समय (कुल) 298.90s 223.24s
पैरामीटर ~9.5T कुल (~878B सक्रिय) ~1.5T कुल (~100B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#20 Claude Fable 5.1

high
लागत
$0.384
समय
102.5s
टोकन
7,824 tok

#11 GPT-5.5

low
लागत
$0.068
समय
37.0s
टोकन
2,339 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Fable 5.1 8.4 7.4 88.9% 1 13.91s 10,608 520 6,503
GPT-5.5 10.0 10.0 100.0% 0 15.04s 7,302 423 6,402

त्वरित तुलना

तुलना जोड़ी बदलें