नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Mistral: Mistral Small 4 vs Qwen: Qwen3.5-122B-A10B

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-03-17

मेट्रिक Mistral Small 4 Mistral Small 4 medium प्रकाशन: 2026-03-16 Qwen3.5-122B-A10B Qwen3.5-122B-A10B none प्रकाशन: 2026-02-24
क्रमांक #55 #52
स्कोअर 5.6 5.8
सुसंगतता 7.0 9.6
प्रति निकाल खर्च 0.502 0.333
एकूण खर्च $0.026 $0.020
बरोबर चाचण्या
प्रति प्रयत्न पास दर 49.0% 37.3%
अस्थिर चाचण्या 6 1
एकूण रन 51 51
आउटपुट टोकन्स 12,288 2,682
रिझनिंग टोकन्स 28,112 0
प्रतिसाद वेळ (सरासरी) 4.18s 3.71s
प्रतिसाद वेळ (कमाल) 25.25s 46.00s
प्रतिसाद वेळ (एकूण) 71.03s 63.06s

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Mistral Small 4 5.6 3.8 66.7% 3 2.67s 4,055 4,778
Qwen3.5-122B-A10B 4.8 10.0 25.0% 0 1.59s 312 0
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Mistral Small 4 3.0 10.0 0.0% 0 25.25s 2,612 10,700
Qwen3.5-122B-A10B 3.0 10.0 0.0% 0 46.00s 1,137 0
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Mistral Small 4 7.3 5.9 83.3% 1 1.23s 335 723
Qwen3.5-122B-A10B 10.0 10.0 100.0% 0 1.01s 243 0
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Mistral Small 4 5.3 7.2 44.4% 1 6.11s 2,621 6,904
Qwen3.5-122B-A10B 5.3 10.0 33.3% 0 465ms 15 0
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Mistral Small 4 4.8 10.0 0.0% 0 2.05s 821 828
Qwen3.5-122B-A10B 5.0 10.0 0.0% 0 1.12s 66 0
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Mistral Small 4 7.3 5.8 83.3% 1 1.38s 540 1,031
Qwen3.5-122B-A10B 4.5 6.8 16.7% 1 585ms 70 0
Puzzle Solving स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Mistral Small 4 3.4 9.7 0.0% 0 2.00s 983 2,338
Qwen3.5-122B-A10B 5.4 10.0 33.3% 0 982ms 575 0
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Mistral Small 4 10.0 10.0 100.0% 0 3.50s 321 810
Qwen3.5-122B-A10B 10.0 10.0 100.0% 0 2.04s 264 0

झटपट तुलना

तुलना जोडी बदला