नेविगेशन
Advertise here

Mercury 2.5 (high) vs GPT-5.6 Sol

average score लगभग बराबर है: 7.1 vs 7.0. Mercury 2.5 (high) की benchmark लागत कम है: $0.031 vs $0.201. GPT-5.6 Sol तेज है: 2.17s vs 4.32s, pass rates 62.1% vs 63.6%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-08

तुलना किए गए मॉडल

रैंक
#134
कुल आउटपुट टोकन
174,547
प्रतिक्रिया समय (औसत)
4.32s
कुल लागत
$0.031
रैंक
#136
कुल आउटपुट टोकन
4,357
प्रतिक्रिया समय (औसत)
2.17s
कुल लागत
$0.201
अनुशंसित मॉडल Mercury 2.5 (high)

It has the best score here (7.1), while costing about 6.5x less than GPT-5.6 Sol.

विस्तृत तुलना

मेट्रिक Mercury 2.5 Mercury 2.5 high रिलीज़: 2026-09-08 GPT-5.6 Sol GPT-5.6 Sol none रिलीज़: 2026-07-09
स्कोर 7.1 7.0
रैंक #134 #136
विश्वसनीयता 9.7 10.0
संगति 8.6 9.0
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 62.1% 63.6%
अस्थिर टेस्ट 4 3
कुल रन 66 66
प्रति परिणाम लागत 0.259 4.365
कुल लागत $0.031 $0.201
इनपुट कीमत $0.040 / 1M $2.000 / 1M
आउटपुट कीमत $0.150 / 1M $10.000 / 1M
कुल इनपुट टोकन 120,068 78,602
आउटपुट टोकन 3,402 4,357
रीजनिंग टोकन 171,145 0
प्रतिक्रिया समय (औसत) 4.32s 2.17s
प्रतिक्रिया समय (अधिकतम) 23.63s 12.81s
प्रतिक्रिया समय (कुल) 95.06s 47.66s
पैरामीटर ~100B ~2T कुल (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#134 Mercury 2.5

high
लागत
$0.001
समय
3.5s
टोकन
2,447 tok

#136 GPT-5.6 Sol

none
लागत
$0.116
समय
78.7s
टोकन
3,944 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Mercury 2.5 6.4 7.8 44.4% 1 6.58s 7,757 415 44,012
GPT-5.6 Sol 5.5 10.0 33.3% 0 1.39s 7,302 390 0

त्वरित तुलना

तुलना जोड़ी बदलें