नेविगेशन
Advertise here

GPT-5.6 Luna (low) vs Space Bunny Alpha (medium)

Space Bunny Alpha (medium) average score में आगे है: 6.3 vs 6.2. Space Bunny Alpha (medium) की benchmark लागत कम है: $0.000 vs $0.051. GPT-5.6 Luna (low) तेज है: 5.20s vs 27.42s, pass rates 54.5% vs 54.6%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-24

तुलना किए गए मॉडल

रैंक
#221
कुल आउटपुट टोकन
26,286
प्रतिक्रिया समय (औसत)
5.20s
कुल लागत
$0.051
रैंक
#214
कुल आउटपुट टोकन
168,654
प्रतिक्रिया समय (औसत)
27.42s
कुल लागत
$0.000
अनुशंसित मॉडल GPT-5.6 Luna (low)

Its score stays close to the best score here (6.2 vs 6.3), while responding about 5.3x faster than Space Bunny Alpha (medium).

विस्तृत तुलना

मेट्रिक GPT-5.6 Luna GPT-5.6 Luna low रिलीज़: 2026-07-09 Space Bunny Alpha Space Bunny Alpha medium रिलीज़: 2026-09-24
स्कोर 6.2 6.3
रैंक #221 #214
विश्वसनीयता 10.0 10.0
संगति 8.2 8.5
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 54.5% 54.6%
अस्थिर टेस्ट 5 4
कुल रन 66 66
प्रति परिणाम लागत 2.437 0.000
कुल लागत $0.051 $0.000
इनपुट कीमत $0.200 / 1M $0.000 / 1M
आउटपुट कीमत $1.200 / 1M $0.000 / 1M
कुल इनपुट टोकन 96,355 131,452
आउटपुट टोकन 8,213 168,654
रीजनिंग टोकन 18,073 0
प्रतिक्रिया समय (औसत) 5.20s 27.42s
प्रतिक्रिया समय (अधिकतम) 19.44s 197.32s
प्रतिक्रिया समय (कुल) 114.46s 603.17s
पैरामीटर ~400B कुल (~17B सक्रिय) -
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#221 GPT-5.6 Luna

low
लागत
$0.011
समय
10.2s
टोकन
1,897 tok

#214 Space Bunny Alpha

medium
लागत
$0.000
समय
35.4s
टोकन
4,894 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.6 Luna 5.5 10.0 33.3% 0 4.61s 7,302 557 3,535
Space Bunny Alpha 5.4 7.2 44.4% 1 6.82s 8,493 6,691 0

त्वरित तुलना

तुलना जोड़ी बदलें