नेविगेशन
AI BENCHY
Advertise here

GPT-5.6 Luna vs MiMo-V2.5-Pro

average score लगभग बराबर है: 5.4 vs 5.4. GPT-5.6 Luna की benchmark लागत कम है: $0.029 vs $0.068. GPT-5.6 Luna तेज है: 1.50s vs 4.24s, pass rates 36.4% vs 33.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-04

रैंक
#241
कुल आउटपुट टोकन
6,709
प्रतिक्रिया समय (औसत)
1.50s
कुल लागत
$0.029
रैंक
#242
कुल आउटपुट टोकन
15,362
प्रतिक्रिया समय (औसत)
4.24s
कुल लागत
$0.068
अनुशंसित मॉडल GPT-5.6 Luna

It has the best score here (5.4), while costing about 2.4x less than MiMo-V2.5-Pro.

विस्तृत तुलना

मेट्रिक GPT-5.6 Luna GPT-5.6 Luna none रिलीज़: 2026-07-09 MiMo-V2.5-Pro MiMo-V2.5-Pro none रिलीज़: 2026-04-22
स्कोर 5.4 5.4
रैंक #241 #242
विश्वसनीयता 10.0 10.0
संगति 8.8 8.6
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 36.4% 33.3%
अस्थिर टेस्ट 3 4
कुल रन 66 66
प्रति परिणाम लागत 2.357 1.808
कुल लागत $0.029 $0.068
इनपुट कीमत $0.200 / 1M $0.435 / 1M
आउटपुट कीमत $1.200 / 1M $0.870 / 1M
कुल इनपुट टोकन 101,332 124,808
आउटपुट टोकन 6,709 15,362
रीजनिंग टोकन 0 0
प्रतिक्रिया समय (औसत) 1.50s 4.24s
प्रतिक्रिया समय (अधिकतम) 10.57s 53.13s
प्रतिक्रिया समय (कुल) 33.05s 93.28s
पैरामीटर ~400B कुल (~17B सक्रिय) 1.02T कुल (42B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#241 GPT-5.6 Luna

none
लागत
$0.016
समय
15.8s
टोकन
2,685 tok

#242 MiMo-V2.5-Pro

none
लागत
$0.004
समय
46.4s
टोकन
4,025 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.6 Luna 3.8 7.2 22.2% 1 980ms 7,302 459 0
MiMo-V2.5-Pro 4.3 7.8 22.2% 1 1.41s 6,559 485 0

त्वरित तुलना

तुलना जोड़ी बदलें