नेव्हिगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Mistral Large 4 (high) vs GPT-5.6 Luna (medium)

Mistral Large 4 (high) average score मध्ये पुढे आहे: 7.5 vs 7.4. GPT-5.6 Luna (medium) चा benchmark खर्च कमी आहे: $0.065 vs $1.391. GPT-5.6 Luna (medium) वेगवान आहे: 9.64s vs 263.69s, pass rates 65.2% vs 62.3%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-06

तुलना केलेली मॉडेल्स

क्रमांक
#126
एकूण आउटपुट टोकन्स
590,306
प्रतिसाद वेळ (सरासरी)
263.69s
एकूण खर्च
$1.391
क्रमांक
#128
एकूण आउटपुट टोकन्स
47,986
प्रतिसाद वेळ (सरासरी)
9.64s
एकूण खर्च
$0.065
शिफारस केलेले मॉडेल GPT-5.6 Luna (medium)

Its score stays close to the best score here (7.4 vs 7.5), while costing about 21.6x less than Mistral Large 4 (high).

तपशीलवार तुलना

मेट्रिक Mistral Large 4 Mistral Large 4 high प्रकाशन: 2026-10-06 GPT-5.6 Luna GPT-5.6 Luna medium प्रकाशन: 2026-07-09
स्कोअर 7.5 7.4
क्रमांक #126 #128
विश्वसनीयता 9.0 10.0
सुसंगतता 7.9 9.0
प्रयत्न 69/69 69/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 65.2% 62.3%
अस्थिर चाचण्या 6 3
एकूण रन 69 69
प्रति निकाल खर्च 11.590 2.822
एकूण खर्च $1.391 $0.065
इनपुट किंमत $0.680 / 1M $0.200 / 1M
आउटपुट किंमत $2.090 / 1M $1.200 / 1M
कॅश वाचण्याची किंमत $0.070 / 1M $0.020 / 1M
कॅश लिहिण्याची किंमत लागू नाही $0.250 / 1M
एकूण इनपुट टोकन्स 230,895 212,780
आउटपुट टोकन्स 161,281 6,849
रिझनिंग टोकन्स 510,655 41,137
प्रतिसाद वेळ (सरासरी) 263.69s 9.64s
प्रतिसाद वेळ (कमाल) 1727.29s 58.09s
प्रतिसाद वेळ (एकूण) 6064.89s 221.62s
पॅरामीटर्स 1.05T एकूण (49B सक्रिय) ~400B एकूण (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#126 Mistral Large 4

high
खर्च
$0.007
वेळ
53.3s
टोकन्स
3,333 tok

#128 GPT-5.6 Luna

medium
खर्च
$0.014
वेळ
14.6s
टोकन्स
2,362 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Mistral Large 4 3.3 4.4 33.3% 2 1277.83s 6,541 53,820 279,694
GPT-5.6 Luna 5.4 7.2 44.4% 1 10.38s 7,302 564 9,928

झटपट तुलना

तुलना जोडी बदला