नेव्हिगेशन
AI BENCHY
Your ad here

AI BENCHY Compare

Trinity Large Preview vs Mistral: Mistral Small 4

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-03-17

मेट्रिक Trinity Large Preview Trinity Large Preview none प्रकाशन: 2026-01-27 मोफत उपलब्ध Mistral Small 4 Mistral Small 4 medium प्रकाशन: 2026-03-16
क्रमांक #60 #55
स्कोअर 5.3 5.6
सुसंगतता 9.6 7.0
प्रति निकाल खर्च 0.000 0.502
एकूण खर्च $0.000 $0.026
बरोबर चाचण्या
प्रति प्रयत्न पास दर 31.4% 49.0%
अस्थिर चाचण्या 1 6
एकूण रन 51 51
आउटपुट टोकन्स 1,843 12,288
रिझनिंग टोकन्स 0 28,112
प्रतिसाद वेळ (सरासरी) 3.04s 4.18s
प्रतिसाद वेळ (कमाल) 8.91s 25.25s
प्रतिसाद वेळ (एकूण) 51.75s 71.03s

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Trinity Large Preview 3.0 10.0 0.0% 0 3.02s 593 0
Mistral Small 4 5.6 3.8 66.7% 3 2.67s 4,055 4,778
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Trinity Large Preview 3.0 10.0 0.0% 0 8.91s 294 0
Mistral Small 4 3.0 10.0 0.0% 0 25.25s 2,612 10,700
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Trinity Large Preview 10.0 10.0 100.0% 0 3.26s 186 0
Mistral Small 4 7.3 5.9 83.3% 1 1.23s 335 723
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Trinity Large Preview 5.3 10.0 33.3% 0 877ms 25 0
Mistral Small 4 5.3 7.2 44.4% 1 6.11s 2,621 6,904
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Trinity Large Preview 4.4 9.9 0.0% 0 2.86s 124 0
Mistral Small 4 4.8 10.0 0.0% 0 2.05s 821 828
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Trinity Large Preview 4.1 6.7 16.7% 1 1.09s 63 0
Mistral Small 4 7.3 5.8 83.3% 1 1.38s 540 1,031
Puzzle Solving स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Trinity Large Preview 5.4 10.0 33.3% 0 3.30s 291 0
Mistral Small 4 3.4 9.7 0.0% 0 2.00s 983 2,338
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Trinity Large Preview 10.0 10.0 100.0% 0 6.67s 267 0
Mistral Small 4 10.0 10.0 100.0% 0 3.50s 321 810

झटपट तुलना

तुलना जोडी बदला