नेविगेशन
Advertise here

GPT-5.6 Luna (medium) vs Inkling Small (high)

average score लगभग बराबर है: 7.4 vs 7.4. GPT-5.6 Luna (medium) की benchmark लागत कम है: $0.101 vs $0.402. GPT-5.6 Luna (medium) तेज है: 9.64s vs 29.10s, pass rates 62.3% vs 66.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#122
कुल आउटपुट टोकन
47,986
प्रतिक्रिया समय (औसत)
9.64s
कुल लागत
$0.101
रैंक
#128
कुल आउटपुट टोकन
298,893
प्रतिक्रिया समय (औसत)
29.10s
कुल लागत
$0.402
अनुशंसित मॉडल GPT-5.6 Luna (medium)

It has the best score here (7.4), while costing about 4.0x less than Inkling Small (high).

विस्तृत तुलना

मेट्रिक GPT-5.6 Luna GPT-5.6 Luna medium रिलीज़: 2026-07-09 Inkling Small Inkling Small high रिलीज़: 2026-08-01 निःशुल्क उपलब्ध
स्कोर 7.4 7.4
रैंक #122 #128
विश्वसनीयता 10.0 10.0
संगति 9.0 9.3
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 62.3% 66.7%
अस्थिर टेस्ट 3 2
कुल रन 69 69
प्रति परिणाम लागत 2.822 2.868
कुल लागत $0.101 $0.402
इनपुट कीमत $0.200 / 1M $0.450 / 1M
आउटपुट कीमत $1.200 / 1M $1.200 / 1M
कुल इनपुट टोकन 212,780 85,669
आउटपुट टोकन 6,849 6,092
रीजनिंग टोकन 41,137 292,801
प्रतिक्रिया समय (औसत) 9.64s 29.10s
प्रतिक्रिया समय (अधिकतम) 58.09s 122.60s
प्रतिक्रिया समय (कुल) 221.62s 669.40s
पैरामीटर ~400B कुल (~17B सक्रिय) 276B कुल (12B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#122 GPT-5.6 Luna

medium
लागत
$0.014
समय
14.6s
टोकन
2,362 tok

#128 Thinking Machines: Inkling Small

high
लागत
$0.006
समय
34.7s
टोकन
4,735 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.6 Luna 5.4 7.2 44.4% 1 10.38s 7,302 564 9,928
Inkling Small 10.0 10.0 100.0% 0 93.23s 7,374 463 120,474

त्वरित तुलना

तुलना जोड़ी बदलें