नेविगेशन
Advertise here

GPT-5.6 Luna (medium) vs Space Bunny Alpha (high)

Space Bunny Alpha (high) average score में आगे है: 7.5 vs 7.4. Space Bunny Alpha (high) की benchmark लागत कम है: $0.000 vs $0.101. GPT-5.6 Luna (medium) तेज है: 9.64s vs 29.38s, pass rates 62.3% vs 63.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#122
कुल आउटपुट टोकन
47,986
प्रतिक्रिया समय (औसत)
9.64s
कुल लागत
$0.101
रैंक
#118
कुल आउटपुट टोकन
181,271
प्रतिक्रिया समय (औसत)
29.38s
कुल लागत
$0.000
अनुशंसित मॉडल GPT-5.6 Luna (medium)

Its score stays close to the best score here (7.4 vs 7.5), while responding about 3.0x faster than Space Bunny Alpha (high).

विस्तृत तुलना

मेट्रिक GPT-5.6 Luna GPT-5.6 Luna medium रिलीज़: 2026-07-09 Space Bunny Alpha Space Bunny Alpha high रिलीज़: 2026-09-24
स्कोर 7.4 7.5
रैंक #122 #118
विश्वसनीयता 10.0 10.0
संगति 9.0 8.5
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 62.3% 63.8%
अस्थिर टेस्ट 3 4
कुल रन 69 69
प्रति परिणाम लागत 2.822 0.000
कुल लागत $0.101 $0.000
इनपुट कीमत $0.200 / 1M $0.000 / 1M
आउटपुट कीमत $1.200 / 1M $0.000 / 1M
कुल इनपुट टोकन 212,780 302,228
आउटपुट टोकन 6,849 181,271
रीजनिंग टोकन 41,137 0
प्रतिक्रिया समय (औसत) 9.64s 29.38s
प्रतिक्रिया समय (अधिकतम) 58.09s 234.56s
प्रतिक्रिया समय (कुल) 221.62s 675.79s
पैरामीटर ~400B कुल (~17B सक्रिय) -
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#122 GPT-5.6 Luna

medium
लागत
$0.014
समय
14.6s
टोकन
2,362 tok

#118 Space Bunny Alpha

high
लागत
$0.000
समय
76.4s
टोकन
8,935 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.6 Luna 5.4 7.2 44.4% 1 10.38s 7,302 564 9,928
Space Bunny Alpha 6.2 7.1 55.6% 1 8.29s 8,493 8,006 0

त्वरित तुलना

तुलना जोड़ी बदलें