नेव्हिगेशन
AI BENCHY
Advertise here

AI BENCHY Compare

MiniMax: MiniMax M3 vs xAI: Grok Build 0.1

सारांश

MiniMax M3 vs Grok Build 0.1 benchmark तुलना: average score जवळपास समान आहे: 7.6 vs 7.6. MiniMax M3 चा benchmark खर्च कमी आहे: $0.131 vs $0.927. Grok Build 0.1 वेगवान आहे: 49.90s vs 68.17s, pass rates 65.1% vs 61.9%.

शिफारस केलेले मॉडेल: MiniMax M3 - It has the best score here (7.6), while costing about 7.1x less than Grok Build 0.1.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-02

मेट्रिक MiniMax M3 MiniMax M3 medium प्रकाशन: 2026-06-01 Grok Build 0.1 Grok Build 0.1 medium प्रकाशन: 2026-05-21
स्कोअर 7.6 7.6
क्रमांक #42 #44
विश्वसनीयता 9.6 10.0
सुसंगतता 7.9 9.9
बरोबर चाचण्या
प्रति प्रयत्न पास दर 65.1% 61.9%
अस्थिर चाचण्या 5 0
एकूण रन 63 63
प्रति निकाल खर्च 1.187 7.124
एकूण खर्च $0.131 $0.927
इनपुट किंमत $0.300 / 1M $1.000 / 1M
आउटपुट किंमत $1.200 / 1M $2.000 / 1M
एकूण इनपुट टोकन्स 46,546 44,418
आउटपुट टोकन्स 49,036 2,782
रिझनिंग टोकन्स 92,543 438,018
प्रतिसाद वेळ (सरासरी) 68.17s 49.90s
प्रतिसाद वेळ (कमाल) 431.03s 252.69s
प्रतिसाद वेळ (एकूण) 1363.38s 1047.92s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#42 MiniMax M3

medium
खर्च
$0.012
वेळ
154.4s
टोकन्स
10,018 tok

#44 xAI: Grok Build 0.1

medium
खर्च
$0.028
वेळ
81.3s
टोकन्स
14,009 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
MiniMax M3 5.5 3.7 66.7% 3 14.95s 2,526 874 3,414
Grok Build 0.1 8.3 10.0 75.0% 0 7.43s 2,010 220 12,162
कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
MiniMax M3 6.1 6.5 55.6% 1 144.74s 5,804 6,223 32,667
Grok Build 0.1 5.7 9.7 33.3% 0 108.46s 8,304 1,138 161,452
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
MiniMax M3 10.0 10.0 100.0% 0 65.30s 14,760 1,306 6,253
Grok Build 0.1 10.0 10.0 100.0% 0 32.81s 12,909 231 16,917
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
MiniMax M3 10.0 10.0 100.0% 0 14.92s 8,088 514 3,164
Grok Build 0.1 10.0 10.0 100.0% 0 10.72s 7,761 180 8,876
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
MiniMax M3 5.5 9.3 33.3% 0 233.13s 869 16,254 19,070
Grok Build 0.1 5.3 10.0 33.3% 0 158.00s 1,764 492 175,294
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
MiniMax M3 5.1 3.4 33.3% 1 33.25s 954 2,487 2,523
Grok Build 0.1 4.4 9.9 0.0% 0 18.41s 825 76 6,345
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
MiniMax M3 9.8 10.0 100.0% 0 6.14s 1,623 103 920
Grok Build 0.1 9.8 10.0 100.0% 0 12.36s 1,362 57 9,599
कोडी सोडवणे स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
MiniMax M3 7.9 9.9 66.7% 0 49.91s 2,079 11,946 13,761
Grok Build 0.1 7.7 10.0 66.7% 0 18.26s 1,689 195 20,841
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
MiniMax M3 10.0 10.0 100.0% 0 11.91s 9,168 281 555
Grok Build 0.1 10.0 10.0 100.0% 0 13.12s 7,263 180 4,969
सामान्य ज्ञान स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
MiniMax M3 3.0 10.0 0.0% 0 100.80s 675 9,048 10,216
Grok Build 0.1 3.0 10.0 0.0% 0 53.51s 531 13 21,563

झटपट तुलना

तुलना जोडी बदला