नेविगेशन
Advertise here

Grok 4.5 (low) vs MiMo-V2.6-Pro (medium)

average score लगभग बराबर है: 8.4 vs 8.4. MiMo-V2.6-Pro (medium) की benchmark लागत कम है: $0.477 vs $0.945. Grok 4.5 (low) तेज है: 16.17s vs 147.50s, pass rates 77.3% vs 77.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-22

तुलना किए गए मॉडल

रैंक
#58
कुल आउटपुट टोकन
115,489
प्रतिक्रिया समय (औसत)
16.17s
कुल लागत
$0.945
रैंक
#61
कुल आउटपुट टोकन
502,443
प्रतिक्रिया समय (औसत)
147.50s
कुल लागत
$0.477
अनुशंसित मॉडल Grok 4.5 (low)

It has the best score here (8.4), while responding about 9.1x faster than MiMo-V2.6-Pro (medium).

विस्तृत तुलना

मेट्रिक Grok 4.5 Grok 4.5 low रिलीज़: 2026-07-08 MiMo-V2.6-Pro MiMo-V2.6-Pro medium रिलीज़: 2026-09-22
स्कोर 8.4 8.4
रैंक #58 #61
विश्वसनीयता 10.0 9.4
संगति 9.3 7.5
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 77.3% 77.3%
अस्थिर टेस्ट 2 7
कुल रन 66 66
प्रति परिणाम लागत 5.901 3.666
कुल लागत $0.945 $0.477
इनपुट कीमत $2.000 / 1M $0.435 / 1M
आउटपुट कीमत $6.000 / 1M $0.870 / 1M
कुल इनपुट टोकन 125,605 90,486
आउटपुट टोकन 7,505 6,569
रीजनिंग टोकन 107,984 495,874
प्रतिक्रिया समय (औसत) 16.17s 147.50s
प्रतिक्रिया समय (अधिकतम) 205.28s 904.91s
प्रतिक्रिया समय (कुल) 355.67s 3245.08s
पैरामीटर ~1.7T कुल (~170B सक्रिय) 1.02T कुल (42B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#58 SpaceXAI: Grok 4.5

low
लागत
$0.011
समय
12.4s
टोकन
2,018 tok

#61 MiMo-V2.6-Pro

medium
लागत
$0.012
समय
185.6s
टोकन
13,493 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Grok 4.5 10.0 10.0 100.0% 0 13.72s 9,579 303 15,641
MiMo-V2.6-Pro 8.2 7.2 88.9% 1 150.44s 7,422 785 94,571

त्वरित तुलना

तुलना जोड़ी बदलें