नेव्हिगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Mistral Large 4 (low) vs GPT-6.1 Sol (low)

GPT-6.1 Sol (low) average score मध्ये पुढे आहे: 9.6 vs 7.6. GPT-6.1 Sol (low) चा benchmark खर्च कमी आहे: $0.460 vs $1.648. GPT-6.1 Sol (low) वेगवान आहे: 7.15s vs 300.15s, pass rates 65.2% vs 92.8%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-06

तुलना केलेली मॉडेल्स

क्रमांक
#119
एकूण आउटपुट टोकन्स
714,287
प्रतिसाद वेळ (सरासरी)
300.15s
एकूण खर्च
$1.648
क्रमांक
#16
एकूण आउटपुट टोकन्स
13,138
प्रतिसाद वेळ (सरासरी)
7.15s
एकूण खर्च
$0.460
शिफारस केलेले मॉडेल GPT-6.1 Sol (low)

It has the best score here (9.6), while costing about 3.6x less than Mistral Large 4 (low).

तपशीलवार तुलना

मेट्रिक Mistral Large 4 Mistral Large 4 low प्रकाशन: 2026-10-06 GPT-6.1 Sol GPT-6.1 Sol low प्रकाशन: 2026-09-29
स्कोअर 7.6 9.6
क्रमांक #119 #16
विश्वसनीयता 9.0 10.0
सुसंगतता 8.7 9.6
प्रयत्न 69/69 69/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 65.2% 92.8%
अस्थिर चाचण्या 4 1
एकूण रन 69 69
प्रति निकाल खर्च 12.670 2.187
एकूण खर्च $1.648 $0.460
इनपुट किंमत $0.680 / 1M $2.000 / 1M
आउटपुट किंमत $2.090 / 1M $10.000 / 1M
कॅश वाचण्याची किंमत $0.070 / 1M $0.100 / 1M
कॅश लिहिण्याची किंमत लागू नाही $2.500 / 1M
एकूण इनपुट टोकन्स 226,734 163,900
आउटपुट टोकन्स 278,013 4,958
रिझनिंग टोकन्स 638,296 8,180
प्रतिसाद वेळ (सरासरी) 300.15s 7.15s
प्रतिसाद वेळ (कमाल) 1798.01s 46.57s
प्रतिसाद वेळ (एकूण) 6903.40s 164.47s
पॅरामीटर्स 1.05T एकूण (49B सक्रिय) ~2T एकूण (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#119 Mistral Large 4

low
खर्च
$0.015
वेळ
115.1s
टोकन्स
6,915 tok

#16 GPT-6.1 Sol

low
खर्च
$0.028
वेळ
44.6s
टोकन्स
2,881 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Mistral Large 4 3.4 7.2 22.2% 1 1379.72s 5,896 129,426 386,126
GPT-6.1 Sol 10.0 10.0 100.0% 0 4.48s 7,302 388 1,286

झटपट तुलना

तुलना जोडी बदला