नेविगेशन
Advertise here

GPT-5.6 Luna (low) vs MiMo-V2.6-Pro

average score लगभग बराबर है: 6.2 vs 6.2. GPT-5.6 Luna (low) की benchmark लागत कम है: $0.051 vs $0.122. GPT-5.6 Luna (low) तेज है: 5.20s vs 7.09s, pass rates 54.5% vs 45.5%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-21

तुलना किए गए मॉडल

रैंक
#205
कुल आउटपुट टोकन
26,286
प्रतिक्रिया समय (औसत)
5.20s
कुल लागत
$0.051
रैंक
#202
कुल आउटपुट टोकन
80,341
प्रतिक्रिया समय (औसत)
7.09s
कुल लागत
$0.122
अनुशंसित मॉडल GPT-5.6 Luna (low)

It has the best score here (6.2), while costing about 2.4x less than MiMo-V2.6-Pro.

विस्तृत तुलना

मेट्रिक GPT-5.6 Luna GPT-5.6 Luna low रिलीज़: 2026-07-09 MiMo-V2.6-Pro MiMo-V2.6-Pro none रिलीज़: 2026-09-22
स्कोर 6.2 6.2
रैंक #205 #202
विश्वसनीयता 10.0 10.0
संगति 8.2 9.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 54.5% 45.5%
अस्थिर टेस्ट 5 2
कुल रन 66 66
प्रति परिणाम लागत 2.437 1.353
कुल लागत $0.051 $0.122
इनपुट कीमत $0.200 / 1M $0.435 / 1M
आउटपुट कीमत $1.200 / 1M $0.870 / 1M
कुल इनपुट टोकन 96,355 119,156
आउटपुट टोकन 8,213 80,341
रीजनिंग टोकन 18,073 0
प्रतिक्रिया समय (औसत) 5.20s 7.09s
प्रतिक्रिया समय (अधिकतम) 19.44s 106.86s
प्रतिक्रिया समय (कुल) 114.46s 155.92s
पैरामीटर ~400B कुल (~17B सक्रिय) 1.02T कुल (42B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#205 GPT-5.6 Luna

low
लागत
$0.011
समय
10.2s
टोकन
1,897 tok

#202 MiMo-V2.6-Pro

none
लागत
$0.002
समय
14.8s
टोकन
2,260 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.6 Luna 5.5 10.0 33.3% 0 4.61s 7,302 557 3,535
MiMo-V2.6-Pro 5.6 9.9 33.3% 0 3.69s 7,440 4,344 0

त्वरित तुलना

तुलना जोड़ी बदलें