नेविगेशन
AI BENCHY
Your ad here

AI BENCHY तुलना

Anthropic: Claude Sonnet 4.6 vs Xiaomi: MiMo-V2-Pro

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-03-20

मेट्रिक Claude Sonnet 4.6 Claude Sonnet 4.6 none रिलीज़: 2026-02-17 MiMo-V2-Pro MiMo-V2-Pro medium रिलीज़: 2026-03-18
स्कोर 7.3 8.0
रैंक #33 #20
संगति 9.6 8.5
सही परीक्षण
प्रति प्रयास पास दर 62.8% 76.5%
अस्थिर टेस्ट 1 3
कुल रन 51 45
प्रति परिणाम लागत 2.512 1.110
कुल लागत $0.252 $0.123
???? ??? $3.000 / 1M $1.000 / 1M
????? ??? $15.000 / 1M $3.000 / 1M
आउटपुट टोकन 6,910 1,875
रीजनिंग टोकन 0 26,959
प्रतिक्रिया समय (औसत) 5.12s 9.78s
प्रतिक्रिया समय (अधिकतम) 23.84s 64.71s
प्रतिक्रिया समय (कुल) 51.16s 156.45s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 4.8 10.0 25.0% 0 2.94s 1,214 0
MiMo-V2-Pro 10.0 10.0 100.0% 0 3.06s 223 1,107
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 9.5 10.0 100.0% 0 23.84s 3,766 0
MiMo-V2-Pro 4.7 1.6 66.7% 1 64.71s 380 14,186
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 10.0 10.0 100.0% 0 3.43s 252 0
MiMo-V2-Pro 7.3 5.8 83.3% 1 17.20s 260 7,484
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 7.7 10.0 66.7% 0 3.54s 413 0
MiMo-V2-Pro 5.3 10.0 33.3% 0 6.00s 155 1,048
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 6.1 3.1 66.7% 1 2.56s 192 0
MiMo-V2-Pro 10.0 10.0 100.0% 0 4.06s 198 424
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 6.5 10.0 50.0% 0 1.96s 90 0
MiMo-V2-Pro 9.9 10.0 100.0% 0 3.36s 83 667
Puzzle Solving स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 7.7 10.0 66.7% 0 2.92s 536 0
MiMo-V2-Pro 7.0 7.2 55.6% 1 4.71s 313 1,179
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 10.0 10.0 100.0% 0 4.11s 447 0
MiMo-V2-Pro 10.0 10.0 100.0% 0 8.19s 263 864

त्वरित तुलना

तुलना जोड़ी बदलें