नेविगेशन
Advertise here

GPT-5.6 Luna (medium) vs MiMo-V2.6-Flash (medium)

GPT-5.6 Luna (medium) average score में आगे है: 7.4 vs 7.4. GPT-5.6 Luna (medium) की benchmark लागत कम है: $0.072 vs $0.190. GPT-5.6 Luna (medium) तेज है: 7.43s vs 60.62s, pass rates 62.1% vs 65.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-22

तुलना किए गए मॉडल

रैंक
#123
कुल आउटपुट टोकन
44,525
प्रतिक्रिया समय (औसत)
7.43s
कुल लागत
$0.072
रैंक
#126
कुल आउटपुट टोकन
615,978
प्रतिक्रिया समय (औसत)
60.62s
कुल लागत
$0.190
अनुशंसित मॉडल GPT-5.6 Luna (medium)

It has the best score here (7.4), while costing about 2.7x less than MiMo-V2.6-Flash (medium).

विस्तृत तुलना

मेट्रिक GPT-5.6 Luna GPT-5.6 Luna medium रिलीज़: 2026-07-09 MiMo-V2.6-Flash MiMo-V2.6-Flash medium रिलीज़: 2026-09-22
स्कोर 7.4 7.4
रैंक #123 #126
विश्वसनीयता 10.0 10.0
संगति 9.2 7.8
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 62.1% 65.2%
अस्थिर टेस्ट 2 6
कुल रन 66 66
प्रति परिणाम लागत 2.601 1.723
कुल लागत $0.072 $0.190
इनपुट कीमत $0.200 / 1M $0.140 / 1M
आउटपुट कीमत $1.200 / 1M $0.280 / 1M
कुल इनपुट टोकन 89,685 121,240
आउटपुट टोकन 5,701 7,516
रीजनिंग टोकन 38,824 608,462
प्रतिक्रिया समय (औसत) 7.43s 60.62s
प्रतिक्रिया समय (अधिकतम) 29.85s 357.28s
प्रतिक्रिया समय (कुल) 163.54s 1333.53s
पैरामीटर ~400B कुल (~17B सक्रिय) 309B कुल (15B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#123 GPT-5.6 Luna

medium
लागत
$0.014
समय
14.6s
टोकन
2,362 tok

#126 MiMo-V2.6-Flash

medium
लागत
$0.004
समय
61.0s
टोकन
10,798 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.6 Luna 5.4 7.2 44.4% 1 10.38s 7,302 564 9,928
MiMo-V2.6-Flash 7.2 5.1 77.8% 2 18.23s 7,422 533 31,521

त्वरित तुलना

तुलना जोड़ी बदलें