नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Mistral: Mistral Small 4 vs MoonshotAI: Kimi K2.5

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-05-01

मेट्रिक Mistral Small 4 Mistral Small 4 medium प्रकाशन: 2026-03-16 Kimi K2.5 Kimi K2.5 none प्रकाशन: 2026-01-27
स्कोअर 5.7 5.5
क्रमांक #99 #102
विश्वसनीयता लागू नाही लागू नाही
सुसंगतता 6.8 8.7
बरोबर चाचण्या
प्रति प्रयत्न पास दर 50.0% 40.7%
अस्थिर चाचण्या 7 3
एकूण रन 54 54
प्रति निकाल खर्च 0.674 0.271
एकूण खर्च $0.034 $0.017
???? ??? $0.150 / 1M $0.440 / 1M
????? ??? $0.600 / 1M $2.000 / 1M
आउटपुट टोकन्स 15,084 2,659
रिझनिंग टोकन्स 39,408 0
प्रतिसाद वेळ (सरासरी) 5.64s 13.37s
प्रतिसाद वेळ (कमाल) 30.49s 42.13s
प्रतिसाद वेळ (एकूण) 101.52s 147.05s

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Mistral Small 4 5.6 3.8 66.7% 3 2.67s 4,055 4,778
Kimi K2.5 3.6 8.4 8.3% 1 6.24s 373 0
कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Mistral Small 4 6.7 3.5 66.7% 1 30.49s 2,796 11,296
Kimi K2.5 10.0 10.0 100.0% 0 38.78s 649 0
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Mistral Small 4 3.0 10.0 0.0% 0 25.25s 2,612 10,700
Kimi K2.5 2.8 2.1 33.3% 1 19.16s 748 0
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Mistral Small 4 7.3 5.9 83.3% 1 1.23s 335 723
Kimi K2.5 7.3 5.8 83.3% 1 42.13s 187 0
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Mistral Small 4 5.3 7.2 44.4% 1 6.11s 2,621 6,904
Kimi K2.5 5.3 10.0 33.3% 0 4.38s 29 0
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Mistral Small 4 4.8 10.0 0.0% 0 2.05s 821 828
Kimi K2.5 10.0 10.0 100.0% 0 4.00s 76 0
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Mistral Small 4 7.3 5.8 83.3% 1 1.38s 540 1,031
Kimi K2.5 6.5 10.0 50.0% 0 2.67s 60 0
कोडी सोडवणे स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Mistral Small 4 3.4 9.7 0.0% 0 2.00s 983 2,338
Kimi K2.5 3.1 10.0 0.0% 0 4.73s 317 0
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Mistral Small 4 10.0 10.0 100.0% 0 3.50s 321 810
Kimi K2.5 10.0 10.0 100.0% 0 13.99s 220 0

झटपट तुलना

तुलना जोडी बदला