नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY तुलना

StepFun: Step 3.7 Flash vs Xiaomi: MiMo-V2-Flash

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-05-29

मेट्रिक Step 3.7 Flash Step 3.7 Flash high रिलीज़: 2026-05-29 MiMo-V2-Flash MiMo-V2-Flash medium रिलीज़: 2025-12-16
स्कोर 7.1 7.1
रैंक #74 #77
विश्वसनीयता 10.0 10.0
संगति 8.2 8.7
सही परीक्षण
प्रति प्रयास पास दर 65.8% 63.3%
अस्थिर टेस्ट 4 3
कुल रन 60 60
प्रति परिणाम लागत 8.723 0.345
कुल लागत $0.960 $0.038
इनपुट कीमत $0.200 / 1M $0.100 / 1M
आउटपुट कीमत $1.150 / 1M $0.300 / 1M
आउटपुट टोकन 828,084 12,458
रीजनिंग टोकन 0 115,182
प्रतिक्रिया समय (औसत) 49.43s 20.28s
प्रतिक्रिया समय (अधिकतम) 192.75s 96.01s
प्रतिक्रिया समय (कुल) 988.58s 283.87s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Step 3.7 Flash 10.0 10.0 100.0% 0 13.40s 42,656 0
MiMo-V2-Flash 8.1 7.9 83.3% 1 15.85s 1,674 23,559
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Step 3.7 Flash 3.6 4.6 25.0% 1 126.82s 164,069 0
MiMo-V2-Flash 4.1 5.8 33.3% 1 7.20s 456 3,648
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Step 3.7 Flash 10.0 10.0 100.0% 0 13.01s 8,802 0
MiMo-V2-Flash 9.8 10.0 100.0% 0 75.68s 442 26,859
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Step 3.7 Flash 10.0 10.0 100.0% 0 14.72s 23,113 0
MiMo-V2-Flash 6.5 10.0 50.0% 0 0ms 153 0
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Step 3.7 Flash 4.1 4.4 44.5% 2 149.64s 410,502 0
MiMo-V2-Flash 5.9 7.2 55.6% 1 96.01s 8,374 42,461
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Step 3.7 Flash 5.5 10.0 0.0% 0 4.17s 2,862 0
MiMo-V2-Flash 4.0 10.0 0.0% 0 4.20s 87 488
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Step 3.7 Flash 9.8 10.0 100.0% 0 1.52s 2,010 0
MiMo-V2-Flash 10.0 10.0 100.0% 0 4.28s 75 3,504
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Step 3.7 Flash 5.3 7.2 44.4% 1 10.22s 25,422 0
MiMo-V2-Flash 7.7 10.0 66.7% 0 3.87s 864 1,948
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Step 3.7 Flash 10.0 10.0 100.0% 0 2.79s 1,172 0
MiMo-V2-Flash 10.0 10.0 100.0% 0 27.78s 321 12,715
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Step 3.7 Flash 3.0 10.0 0.0% 0 149.34s 147,476 0
MiMo-V2-Flash 3.0 10.0 0.0% 0 1.96s 12 0

त्वरित तुलना

तुलना जोड़ी बदलें