नेविगेशन
Advertise here

GPT-6 Luna (high) vs MiMo-V2.6-Pro (medium)

MiMo-V2.6-Pro (medium) average score में आगे है: 8.4 vs 8.3. GPT-6 Luna (high) की benchmark लागत कम है: $0.054 vs $0.477. GPT-6 Luna (high) तेज है: 17.53s vs 147.50s, pass rates 75.8% vs 77.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-23

तुलना किए गए मॉडल

रैंक
#73
कुल आउटपुट टोकन
91,405
प्रतिक्रिया समय (औसत)
17.53s
कुल लागत
$0.054
रैंक
#66
कुल आउटपुट टोकन
502,443
प्रतिक्रिया समय (औसत)
147.50s
कुल लागत
$0.477
अनुशंसित मॉडल GPT-6 Luna (high)

Its score stays close to the best score here (8.3 vs 8.4), while costing about 8.9x less than MiMo-V2.6-Pro (medium).

विस्तृत तुलना

मेट्रिक GPT-6 Luna GPT-6 Luna high रिलीज़: 2026-09-23 MiMo-V2.6-Pro MiMo-V2.6-Pro medium रिलीज़: 2026-09-22
स्कोर 8.3 8.4
रैंक #73 #66
विश्वसनीयता 10.0 9.4
संगति 9.0 7.5
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 75.8% 77.3%
अस्थिर टेस्ट 3 7
कुल रन 66 66
प्रति परिणाम लागत 0.359 3.666
कुल लागत $0.054 $0.477
इनपुट कीमत $0.100 / 1M $0.435 / 1M
आउटपुट कीमत $0.500 / 1M $0.870 / 1M
कुल इनपुट टोकन 80,441 90,486
आउटपुट टोकन 4,761 6,569
रीजनिंग टोकन 86,644 495,874
प्रतिक्रिया समय (औसत) 17.53s 147.50s
प्रतिक्रिया समय (अधिकतम) 106.93s 904.91s
प्रतिक्रिया समय (कुल) 385.74s 3245.08s
पैरामीटर ~400B कुल (~17B सक्रिय) 1.02T कुल (42B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#73 GPT-6 Luna

high
लागत
$0.003
समय
49.2s
टोकन
5,231 tok

#66 MiMo-V2.6-Pro

medium
लागत
$0.012
समय
185.6s
टोकन
13,493 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-6 Luna 7.8 7.4 77.8% 1 24.69s 7,302 483 15,691
MiMo-V2.6-Pro 8.2 7.2 88.9% 1 150.44s 7,422 785 94,571

त्वरित तुलना

तुलना जोड़ी बदलें