नेविगेशन
AI BENCHY
Advertise here

Claude Fable 5.1 (low) vs GPT-5.5

GPT-5.5 average score में आगे है: 7.0 vs 6.9. GPT-5.5 की benchmark लागत कम है: $0.544 vs $2.565. GPT-5.5 तेज है: 2.35s vs 10.33s, pass rates 56.1% vs 59.1%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-02

रैंक
#130
कुल आउटपुट टोकन
24,375
प्रतिक्रिया समय (औसत)
10.33s
कुल लागत
$2.565
रैंक
#124
कुल आउटपुट टोकन
4,915
प्रतिक्रिया समय (औसत)
2.35s
कुल लागत
$0.544
अनुशंसित मॉडल GPT-5.5

It has the best score here (7.0), while costing about 4.7x less than Claude Fable 5.1 (low).

विस्तृत तुलना

मेट्रिक Claude Fable 5.1 Claude Fable 5.1 low रिलीज़: 2026-09-02 GPT-5.5 GPT-5.5 none रिलीज़: 2026-04-24
स्कोर 6.9 7.0
रैंक #130 #124
विश्वसनीयता 10.0 10.0
संगति 9.2 9.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 56.1% 59.1%
अस्थिर टेस्ट 2 2
कुल रन 66 66
प्रति परिणाम लागत 23.315 4.533
कुल लागत $2.565 $0.544
इनपुट कीमत $10.000 / 1M $5.000 / 1M
आउटपुट कीमत $50.000 / 1M $30.000 / 1M
कुल इनपुट टोकन 134,582 79,294
आउटपुट टोकन 8,955 4,915
रीजनिंग टोकन 15,420 0
प्रतिक्रिया समय (औसत) 10.33s 2.35s
प्रतिक्रिया समय (अधिकतम) 33.10s 12.24s
प्रतिक्रिया समय (कुल) 227.37s 51.78s
पैरामीटर ~9.5T कुल (~878B सक्रिय) ~1.5T कुल (~100B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#130 Claude Fable 5.1

low
लागत
$0.126
समय
28.5s
टोकन
2,652 tok

#124 GPT-5.5

none
लागत
$0.090
समय
54.3s
टोकन
3,063 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Fable 5.1 3.4 10.0 0.0% 0 6.75s 10,608 1,753 0
GPT-5.5 5.5 10.0 33.3% 0 1.35s 7,305 462 0

त्वरित तुलना

तुलना जोड़ी बदलें