नेव्हिगेशन
AI BENCHY
Your ad here

AI BENCHY Compare

Owl Alpha vs Xiaomi: MiMo-V2-Flash

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-05-01

मेट्रिक Owl Alpha Owl Alpha medium प्रकाशन: 2026-04-30 MiMo-V2-Flash MiMo-V2-Flash none प्रकाशन: 2025-12-16
स्कोअर 5.8 4.5
क्रमांक #92 #129
विश्वसनीयता 10.0 लागू नाही
सुसंगतता 9.5 7.8
बरोबर चाचण्या
प्रति प्रयत्न पास दर 40.7% 27.8%
अस्थिर चाचण्या 1 5
एकूण रन 54 54
प्रति निकाल खर्च 0.000 0.753
एकूण खर्च $0.000 $0.023
???? ??? $0.000 / 1M $0.090 / 1M
????? ??? $0.000 / 1M $0.290 / 1M
आउटपुट टोकन्स 1,596 68,522
रिझनिंग टोकन्स 0 0
प्रतिसाद वेळ (सरासरी) 11.04s 2.79s
प्रतिसाद वेळ (कमाल) 58.63s 19.68s
प्रतिसाद वेळ (एकूण) 198.65s 39.08s

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Owl Alpha 4.8 10.0 25.0% 0 3.97s 87 0
MiMo-V2-Flash 3.2 8.0 8.3% 1 1.19s 865 0
कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Owl Alpha 10.0 10.0 100.0% 0 7.35s 402 0
MiMo-V2-Flash 6.3 3.7 33.3% 1 2.79s 726 0
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Owl Alpha 3.0 10.0 0.0% 0 10.01s 315 0
MiMo-V2-Flash 3.0 10.0 0.0% 0 2.87s 330 0
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Owl Alpha 10.0 10.0 100.0% 0 21.64s 246 0
MiMo-V2-Flash 2.9 5.8 16.7% 1 19.68s 161 0
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Owl Alpha 5.3 10.0 33.3% 0 8.58s 28 0
MiMo-V2-Flash 5.3 7.2 44.4% 1 564ms 24 0
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Owl Alpha 4.3 10.0 0.0% 0 58.63s 98 0
MiMo-V2-Flash 4.6 10.0 0.0% 0 1.67s 104 0
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Owl Alpha 6.3 10.0 50.0% 0 9.59s 57 0
MiMo-V2-Flash 6.5 10.0 50.0% 0 857ms 69 0
कोडी सोडवणे स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Owl Alpha 3.4 7.2 11.1% 1 3.44s 135 0
MiMo-V2-Flash 3.6 7.2 22.2% 1 1.38s 65,971 0
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Owl Alpha 10.0 10.0 100.0% 0 8.26s 228 0
MiMo-V2-Flash 10.0 10.0 100.0% 0 2.28s 272 0

झटपट तुलना

तुलना जोडी बदला