नेविगेशन
AI BENCHY
Advertise here

GPT-5.6 Luna (medium) vs Solar Pro 4 (xhigh)

Solar Pro 4 (xhigh) average score में आगे है: 7.7 vs 7.6. GPT-5.6 Luna (medium) की benchmark लागत कम है: $0.036 vs $0.049. GPT-5.6 Luna (medium) तेज है: 7.28s vs 115.81s, pass rates 65.2% vs 65.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-11

रैंक
#69
कुल आउटपुट टोकन
43,679
प्रतिक्रिया समय (औसत)
7.28s
कुल लागत
$0.036
रैंक
#63
कुल आउटपुट टोकन
379,812
प्रतिक्रिया समय (औसत)
115.81s
कुल लागत
$0.049
अनुशंसित मॉडल GPT-5.6 Luna (medium)

Its score stays close to the best score here (7.6 vs 7.7), while responding about 15.9x faster than Solar Pro 4 (xhigh).

विस्तृत तुलना

मेट्रिक GPT-5.6 Luna GPT-5.6 Luna medium रिलीज़: 2026-07-09 Solar Pro 4 Solar Pro 4 xhigh रिलीज़: 2026-08-11
स्कोर 7.6 7.7
रैंक #69 #63
विश्वसनीयता 10.0 10.0
संगति 9.6 9.4
बेंचमार्क कवरेज 22/22 टेस्ट · 66/66 प्रयास 22/22 टेस्ट · 66/66 प्रयास
सही परीक्षण
प्रति प्रयास पास दर 65.2% 65.2%
अस्थिर टेस्ट 1 2
कुल रन 66 66
प्रति परिणाम लागत 2.513 0.374
कुल लागत $0.036 $0.049
इनपुट कीमत $0.100 / 1M $0.030 / 1M
आउटपुट कीमत $0.600 / 1M $0.120 / 1M
कुल इनपुट टोकन 89,676 98,107
आउटपुट टोकन 5,699 21,723
रीजनिंग टोकन 37,980 358,089
प्रतिक्रिया समय (औसत) 7.28s 115.81s
प्रतिक्रिया समय (अधिकतम) 29.85s 419.47s
प्रतिक्रिया समय (कुल) 160.27s 2547.92s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#69 GPT-5.6 Luna

medium
लागत
$0.014
समय
14.6s
टोकन
2,362 tok

#63 Solar Pro 4

xhigh
इस मॉडल के लिए अभी तक कोई शोकेस परिणाम उत्पन्न नहीं हुआ है।
लागत
$0.000
समय
-
टोकन
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.6 Luna 5.4 7.2 44.4% 1 10.38s 7,302 564 9,928
Solar Pro 4 5.8 9.9 33.3% 0 292.21s 7,887 15,575 115,426

त्वरित तुलना

तुलना जोड़ी बदलें