नेविगेशन
AI BENCHY
Your ad here

AI BENCHY तुलना

Owl Alpha vs Xiaomi: MiMo-V2-Flash

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-05-01

मेट्रिक Owl Alpha Owl Alpha medium रिलीज़: 2026-04-30 MiMo-V2-Flash MiMo-V2-Flash none रिलीज़: 2025-12-16
स्कोर 5.8 4.5
रैंक #92 #129
विश्वसनीयता 10.0 लागू नहीं
संगति 9.5 7.8
सही परीक्षण
प्रति प्रयास पास दर 40.7% 27.8%
अस्थिर टेस्ट 1 5
कुल रन 54 54
प्रति परिणाम लागत 0.000 0.753
कुल लागत $0.000 $0.023
???? ??? $0.000 / 1M $0.090 / 1M
????? ??? $0.000 / 1M $0.290 / 1M
आउटपुट टोकन 1,596 68,522
रीजनिंग टोकन 0 0
प्रतिक्रिया समय (औसत) 11.04s 2.79s
प्रतिक्रिया समय (अधिकतम) 58.63s 19.68s
प्रतिक्रिया समय (कुल) 198.65s 39.08s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Owl Alpha 4.8 10.0 25.0% 0 3.97s 87 0
MiMo-V2-Flash 3.2 8.0 8.3% 1 1.19s 865 0
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Owl Alpha 10.0 10.0 100.0% 0 7.35s 402 0
MiMo-V2-Flash 6.3 3.7 33.3% 1 2.79s 726 0
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Owl Alpha 3.0 10.0 0.0% 0 10.01s 315 0
MiMo-V2-Flash 3.0 10.0 0.0% 0 2.87s 330 0
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Owl Alpha 10.0 10.0 100.0% 0 21.64s 246 0
MiMo-V2-Flash 2.9 5.8 16.7% 1 19.68s 161 0
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Owl Alpha 5.3 10.0 33.3% 0 8.58s 28 0
MiMo-V2-Flash 5.3 7.2 44.4% 1 564ms 24 0
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Owl Alpha 4.3 10.0 0.0% 0 58.63s 98 0
MiMo-V2-Flash 4.6 10.0 0.0% 0 1.67s 104 0
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Owl Alpha 6.3 10.0 50.0% 0 9.59s 57 0
MiMo-V2-Flash 6.5 10.0 50.0% 0 857ms 69 0
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Owl Alpha 3.4 7.2 11.1% 1 3.44s 135 0
MiMo-V2-Flash 3.6 7.2 22.2% 1 1.38s 65,971 0
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Owl Alpha 10.0 10.0 100.0% 0 8.26s 228 0
MiMo-V2-Flash 10.0 10.0 100.0% 0 2.28s 272 0

त्वरित तुलना

तुलना जोड़ी बदलें