नेव्हिगेशन
AI BENCHY
Advertise here

Trinity Large Thinking (high) vs Mistral Small 4

Mistral Small 4 average score मध्ये पुढे आहे: 5.1 vs 4.8. Mistral Small 4 चा benchmark खर्च कमी आहे: $0.022 vs $0.632. Mistral Small 4 वेगवान आहे: 1.20s vs 77.22s, pass rates 39.4% vs 25.8%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-28

क्रमांक
#202
एकूण आउटपुट टोकन्स
953,758
प्रतिसाद वेळ (सरासरी)
77.22s
एकूण खर्च
$0.632
क्रमांक
#185
एकूण आउटपुट टोकन्स
9,812
प्रतिसाद वेळ (सरासरी)
1.20s
एकूण खर्च
$0.022
शिफारस केलेले मॉडेल Mistral Small 4

It has the best score here (5.1), while costing about 29.3x less than Trinity Large Thinking (high).

तपशीलवार तुलना

मेट्रिक Trinity Large Thinking Trinity Large Thinking high प्रकाशन: 2026-07-28 Mistral Small 4 Mistral Small 4 none प्रकाशन: 2026-03-16
स्कोअर 4.8 5.1
क्रमांक #202 #185
विश्वसनीयता 9.9 10.0
सुसंगतता 7.2 9.6
बरोबर चाचण्या
प्रति प्रयत्न पास दर 39.4% 25.8%
अस्थिर चाचण्या 8 1
एकूण रन 66 66
प्रति निकाल खर्च 12.640 0.432
एकूण खर्च $0.632 $0.022
इनपुट किंमत $0.220 / 1M $0.150 / 1M
आउटपुट किंमत $0.850 / 1M $0.600 / 1M
एकूण इनपुट टोकन्स 101,767 104,708
आउटपुट टोकन्स 286,218 9,812
रिझनिंग टोकन्स 667,540 0
प्रतिसाद वेळ (सरासरी) 77.22s 1.20s
प्रतिसाद वेळ (कमाल) 510.21s 13.16s
प्रतिसाद वेळ (एकूण) 1698.89s 26.38s

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#202 Trinity Large Thinking

high
खर्च
$0.028
वेळ
130.1s
टोकन्स
34,387 tok

#185 Mistral Small 4

none
खर्च
$0.002
वेळ
10.4s
टोकन्स
2,370 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Trinity Large Thinking 3.7 4.7 33.3% 2 245.04s 7,204 83,616 266,836
Mistral Small 4 3.7 9.7 0.0% 0 901ms 7,636 619 0

झटपट तुलना

तुलना जोडी बदला