नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Mistral: Mistral Small 4 vs Owl Alpha

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-05-01

मेट्रिक Mistral Small 4 Mistral Small 4 medium प्रकाशन: 2026-03-16 Owl Alpha Owl Alpha medium प्रकाशन: 2026-04-30
स्कोअर 5.7 5.8
क्रमांक #99 #92
विश्वसनीयता लागू नाही 10.0
सुसंगतता 6.8 9.5
बरोबर चाचण्या
प्रति प्रयत्न पास दर 50.0% 40.7%
अस्थिर चाचण्या 7 1
एकूण रन 54 54
प्रति निकाल खर्च 0.674 0.000
एकूण खर्च $0.034 $0.000
???? ??? $0.150 / 1M $0.000 / 1M
????? ??? $0.600 / 1M $0.000 / 1M
आउटपुट टोकन्स 15,084 1,596
रिझनिंग टोकन्स 39,408 0
प्रतिसाद वेळ (सरासरी) 5.64s 11.04s
प्रतिसाद वेळ (कमाल) 30.49s 58.63s
प्रतिसाद वेळ (एकूण) 101.52s 198.65s

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Mistral Small 4 5.6 3.8 66.7% 3 2.67s 4,055 4,778
Owl Alpha 4.8 10.0 25.0% 0 3.97s 87 0
कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Mistral Small 4 6.7 3.5 66.7% 1 30.49s 2,796 11,296
Owl Alpha 10.0 10.0 100.0% 0 7.35s 402 0
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Mistral Small 4 3.0 10.0 0.0% 0 25.25s 2,612 10,700
Owl Alpha 3.0 10.0 0.0% 0 10.01s 315 0
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Mistral Small 4 7.3 5.9 83.3% 1 1.23s 335 723
Owl Alpha 10.0 10.0 100.0% 0 21.64s 246 0
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Mistral Small 4 5.3 7.2 44.4% 1 6.11s 2,621 6,904
Owl Alpha 5.3 10.0 33.3% 0 8.58s 28 0
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Mistral Small 4 4.8 10.0 0.0% 0 2.05s 821 828
Owl Alpha 4.3 10.0 0.0% 0 58.63s 98 0
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Mistral Small 4 7.3 5.8 83.3% 1 1.38s 540 1,031
Owl Alpha 6.3 10.0 50.0% 0 9.59s 57 0
कोडी सोडवणे स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Mistral Small 4 3.4 9.7 0.0% 0 2.00s 983 2,338
Owl Alpha 3.4 7.2 11.1% 1 3.44s 135 0
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Mistral Small 4 10.0 10.0 100.0% 0 3.50s 321 810
Owl Alpha 10.0 10.0 100.0% 0 8.26s 228 0

झटपट तुलना

तुलना जोडी बदला