नेव्हिगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Mistral Large 4 (medium) vs GPT-6.1 Sol (low)

GPT-6.1 Sol (low) average score मध्ये पुढे आहे: 9.6 vs 6.2. GPT-6.1 Sol (low) चा benchmark खर्च कमी आहे: $0.460 vs $1.456. GPT-6.1 Sol (low) वेगवान आहे: 7.15s vs 265.03s, pass rates 55.1% vs 92.8%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-06

तुलना केलेली मॉडेल्स

क्रमांक
#240
एकूण आउटपुट टोकन्स
627,233
प्रतिसाद वेळ (सरासरी)
265.03s
एकूण खर्च
$1.456
क्रमांक
#16
एकूण आउटपुट टोकन्स
13,138
प्रतिसाद वेळ (सरासरी)
7.15s
एकूण खर्च
$0.460
शिफारस केलेले मॉडेल GPT-6.1 Sol (low)

It has the best score here (9.6), while costing about 3.2x less than Mistral Large 4 (medium).

तपशीलवार तुलना

मेट्रिक Mistral Large 4 Mistral Large 4 medium प्रकाशन: 2026-10-06 GPT-6.1 Sol GPT-6.1 Sol low प्रकाशन: 2026-09-29
स्कोअर 6.2 9.6
क्रमांक #240 #16
विश्वसनीयता 9.2 10.0
सुसंगतता 7.6 9.6
प्रयत्न 69/69 69/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 55.1% 92.8%
अस्थिर चाचण्या 7 1
एकूण रन 69 69
प्रति निकाल खर्च 16.168 2.187
एकूण खर्च $1.456 $0.460
इनपुट किंमत $0.680 / 1M $2.000 / 1M
आउटपुट किंमत $2.090 / 1M $10.000 / 1M
कॅश वाचण्याची किंमत $0.070 / 1M $0.100 / 1M
कॅश लिहिण्याची किंमत लागू नाही $2.500 / 1M
एकूण इनपुट टोकन्स 212,024 163,900
आउटपुट टोकन्स 166,422 4,958
रिझनिंग टोकन्स 562,095 8,180
प्रतिसाद वेळ (सरासरी) 265.03s 7.15s
प्रतिसाद वेळ (कमाल) 1760.20s 46.57s
प्रतिसाद वेळ (एकूण) 6095.69s 164.47s
पॅरामीटर्स 1.05T एकूण (49B सक्रिय) ~2T एकूण (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#240 Mistral Large 4

medium
खर्च
$0.011
वेळ
63.4s
टोकन्स
5,291 tok

#16 GPT-6.1 Sol

low
खर्च
$0.028
वेळ
44.6s
टोकन्स
2,881 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Mistral Large 4 3.4 7.2 22.2% 1 1201.87s 7,189 33,530 303,140
GPT-6.1 Sol 10.0 10.0 100.0% 0 4.48s 7,302 388 1,286

झटपट तुलना

तुलना जोडी बदला