नेविगेशन
Advertise here

Grok 4.6 (low) vs MiMo-V2.5 (medium)

MiMo-V2.5 (medium) average score में आगे है: 7.1 vs 6.9. MiMo-V2.5 (medium) की benchmark लागत कम है: $0.419 vs $0.781. Grok 4.6 (low) तेज है: 16.44s vs 49.20s, pass rates 66.7% vs 69.6%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#159
कुल आउटपुट टोकन
42,315
प्रतिक्रिया समय (औसत)
16.44s
कुल लागत
$0.781
रैंक
#152
कुल आउटपुट टोकन
341,511
प्रतिक्रिया समय (औसत)
49.20s
कुल लागत
$0.419
अनुशंसित मॉडल MiMo-V2.5 (medium)

It has the best score here (7.1), while costing about 1.9x less than Grok 4.6 (low).

विस्तृत तुलना

मेट्रिक Grok 4.6 Grok 4.6 low रिलीज़: 2026-08-12 MiMo-V2.5 MiMo-V2.5 medium रिलीज़: 2026-04-22
स्कोर 6.9 7.1
रैंक #159 #152
विश्वसनीयता 10.0 10.0
संगति 9.6 7.6
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 66.7% 69.6%
अस्थिर टेस्ट 1 7
कुल रन 69 69
प्रति परिणाम लागत 5.205 3.491
कुल लागत $0.781 $0.419
इनपुट कीमत $2.000 / 1M $0.140 / 1M
आउटपुट कीमत $6.000 / 1M $0.280 / 1M
कुल इनपुट टोकन 263,427 259,664
आउटपुट टोकन 6,006 8,414
रीजनिंग टोकन 36,309 333,097
प्रतिक्रिया समय (औसत) 16.44s 49.20s
प्रतिक्रिया समय (अधिकतम) 57.97s 316.27s
प्रतिक्रिया समय (कुल) 378.14s 1131.69s
पैरामीटर ~1.7T कुल (~170B सक्रिय) 310B कुल (15B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#159 SpaceXAI: Grok 4.6

low
लागत
$0.011
समय
26.0s
टोकन
1,941 tok

#152 MiMo-V2.5

medium
लागत
$0.002
समय
54.8s
टोकन
5,247 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Grok 4.6 5.5 7.1 44.4% 1 21.69s 9,579 349 7,740
MiMo-V2.5 6.2 4.7 66.7% 2 97.14s 7,422 557 81,977

त्वरित तुलना

तुलना जोड़ी बदलें