नेविगेशन
AI BENCHY
Advertise here

Claude Fable 5 (medium) vs GPT-5.6 Sol (low)

GPT-5.6 Sol (low) average score में आगे है: 9.5 vs 8.6. GPT-5.6 Sol (low) की benchmark लागत कम है: $0.496 vs $3.004. GPT-5.6 Sol (low) तेज है: 9.04s vs 15.01s, pass rates 78.8% vs 86.4%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-20

रैंक
#33
कुल आउटपुट टोकन
42,146
प्रतिक्रिया समय (औसत)
15.01s
कुल लागत
$3.004
रैंक
#4
कुल आउटपुट टोकन
19,946
प्रतिक्रिया समय (औसत)
9.04s
कुल लागत
$0.496
अनुशंसित मॉडल GPT-5.6 Sol (low)

It has the best score here (9.5), while costing about 6.1x less than Claude Fable 5 (medium).

विस्तृत तुलना

मेट्रिक Claude Fable 5 Claude Fable 5 medium रिलीज़: 2026-06-10 GPT-5.6 Sol GPT-5.6 Sol low रिलीज़: 2026-07-09
स्कोर 8.6 9.5
रैंक #33 #4
विश्वसनीयता 10.0 10.0
संगति 9.6 9.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 78.8% 86.4%
अस्थिर टेस्ट 1 2
कुल रन 66 66
प्रति परिणाम लागत 17.669 5.508
कुल लागत $3.004 $0.496
इनपुट कीमत $10.000 / 1M $2.500 / 1M
आउटपुट कीमत $50.000 / 1M $15.000 / 1M
कुल इनपुट टोकन 89,640 78,580
आउटपुट टोकन 33,092 4,476
रीजनिंग टोकन 9,054 15,470
प्रतिक्रिया समय (औसत) 15.01s 9.04s
प्रतिक्रिया समय (अधिकतम) 80.80s 53.91s
प्रतिक्रिया समय (कुल) 330.15s 198.97s
पैरामीटर ~9.5T कुल (~878B सक्रिय) ~2T कुल (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#33 Claude Fable 5

medium
लागत
$0.606
समय
156.7s
टोकन
12,264 tok

#4 GPT-5.6 Sol

low
लागत
$0.062
समय
26.7s
टोकन
2,150 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Fable 5 10.0 10.0 100.0% 0 15.59s 10,590 7,383 1,318
GPT-5.6 Sol 10.0 10.0 100.0% 0 11.25s 7,302 412 3,482

त्वरित तुलना

तुलना जोड़ी बदलें