नेविगेशन
AI BENCHY
Advertise here

तुलना किए गए मॉडल

GPT-5.6 Sol (medium) vs GPT-5.6 Terra (medium) vs GPT-5.6 Luna (medium) vs GPT-5.5 (medium) benchmark तुलना: GPT-5.6 Sol (medium) स्कोर में 9.4 के साथ आगे है। GPT-5.6 Sol (medium) विश्वसनीयता में 10.0 के साथ आगे है। GPT-5.6 Luna (medium) का कुल लागत सबसे कम है: $0.072. GPT-5.6 Terra (medium) 6.85s पर सबसे तेज है।

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-20

रैंक
#8
कुल आउटपुट टोकन
34,977
प्रतिक्रिया समय (औसत)
12.63s
कुल लागत
$0.723
रैंक
#66
कुल आउटपुट टोकन
30,349
प्रतिक्रिया समय (औसत)
6.85s
कुल लागत
$0.523
रैंक
#93
कुल आउटपुट टोकन
44,525
प्रतिक्रिया समय (औसत)
7.43s
कुल लागत
$0.072
रैंक
#19
कुल आउटपुट टोकन
125,316
प्रतिक्रिया समय (औसत)
38.97s
कुल लागत
$4.163
अनुशंसित मॉडल GPT-5.6 Sol (medium)

It has the best score here (9.4), while costing about 2.2x less than इस तुलना के बाकी मॉडल.

विस्तृत तुलना

मेट्रिक GPT-5.6 Sol GPT-5.6 Sol medium रिलीज़: 2026-07-09 GPT-5.6 Terra GPT-5.6 Terra medium रिलीज़: 2026-07-09 GPT-5.6 Luna GPT-5.6 Luna medium रिलीज़: 2026-07-09 GPT-5.5 GPT-5.5 medium रिलीज़: 2026-04-24
स्कोर 9.4 7.8 7.4 9.0
रैंक #8 #66 #93 #19
विश्वसनीयता 10.0 10.0 10.0 10.0
संगति 8.9 9.3 9.2 8.9
प्रयास 66/66 66/66 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 90.9% 69.7% 62.1% 87.9%
अस्थिर टेस्ट 3 2 2 3
कुल रन 66 66 66 66
प्रति परिणाम लागत 8.025 4.603 2.601 23.127
कुल लागत $0.723 $0.523 $0.072 $4.163
इनपुट कीमत $2.500 / 1M $2.000 / 1M $0.200 / 1M $5.000 / 1M
आउटपुट कीमत $15.000 / 1M $12.000 / 1M $1.200 / 1M $30.000 / 1M
कुल इनपुट टोकन 79,006 79,184 89,685 80,668
आउटपुट टोकन 4,696 4,878 5,701 5,617
रीजनिंग टोकन 30,281 25,471 38,824 119,699
प्रतिक्रिया समय (औसत) 12.63s 6.85s 7.43s 38.97s
प्रतिक्रिया समय (अधिकतम) 79.40s 41.68s 29.85s 332.10s
प्रतिक्रिया समय (कुल) 277.88s 150.65s 163.54s 857.43s
पैरामीटर ~2T कुल (~150B सक्रिय) ~1T कुल (~60B सक्रिय) ~400B कुल (~17B सक्रिय) ~1.5T कुल (~100B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#8 GPT-5.6 Sol

medium
लागत
$0.124
समय
57.2s
टोकन
4,199 tok

#66 GPT-5.6 Terra

medium
लागत
$0.035
समय
16.3s
टोकन
2,418 tok

#93 GPT-5.6 Luna

medium
लागत
$0.014
समय
14.6s
टोकन
2,362 tok

#19 GPT-5.5

medium
लागत
$0.112
समय
71.9s
टोकन
3,807 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.6 Sol 10.0 10.0 100.0% 0 9.40s 7,302 394 4,706
GPT-5.6 Terra 6.1 7.2 55.6% 1 7.19s 7,302 427 4,527
GPT-5.6 Luna 5.4 7.2 44.4% 1 10.38s 7,302 564 9,928
GPT-5.5 8.8 7.8 88.9% 1 59.77s 7,305 362 24,959

त्वरित तुलना

तुलना जोड़ी बदलें