नेव्हिगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Mistral Large 4 vs GPT-6 Luna (medium)

GPT-6 Luna (medium) average score मध्ये पुढे आहे: 8.3 vs 5.5. GPT-6 Luna (medium) चा benchmark खर्च कमी आहे: $0.047 vs $0.353. GPT-6 Luna (medium) वेगवान आहे: 18.07s vs 28.46s, pass rates 30.4% vs 73.9%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-06

तुलना केलेली मॉडेल्स

क्रमांक
#274
एकूण आउटपुट टोकन्स
84,218
प्रतिसाद वेळ (सरासरी)
28.46s
एकूण खर्च
$0.353
क्रमांक
#79
एकूण आउटपुट टोकन्स
53,161
प्रतिसाद वेळ (सरासरी)
18.07s
एकूण खर्च
$0.047
शिफारस केलेले मॉडेल GPT-6 Luna (medium)

It has the best score here (8.3), while costing about 7.5x less than Mistral Large 4.

तपशीलवार तुलना

मेट्रिक Mistral Large 4 Mistral Large 4 none प्रकाशन: 2026-10-06 GPT-6 Luna GPT-6 Luna medium प्रकाशन: 2026-09-23
स्कोअर 5.5 8.3
क्रमांक #274 #79
विश्वसनीयता 9.9 10.0
सुसंगतता 8.8 8.9
प्रयत्न 69/69 69/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 30.4% 73.9%
अस्थिर चाचण्या 4 3
एकूण रन 69 69
प्रति निकाल खर्च 7.044 0.313
एकूण खर्च $0.353 $0.047
इनपुट किंमत $0.680 / 1M $0.100 / 1M
आउटपुट किंमत $2.090 / 1M $0.500 / 1M
कॅश वाचण्याची किंमत $0.070 / 1M $0.010 / 1M
कॅश लिहिण्याची किंमत लागू नाही $0.125 / 1M
एकूण इनपुट टोकन्स 259,048 203,193
आउटपुट टोकन्स 84,218 5,751
रिझनिंग टोकन्स 0 47,410
प्रतिसाद वेळ (सरासरी) 28.46s 18.07s
प्रतिसाद वेळ (कमाल) 385.10s 66.44s
प्रतिसाद वेळ (एकूण) 654.47s 415.53s
पॅरामीटर्स 1.05T एकूण (49B सक्रिय) ~400B एकूण (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#274 Mistral Large 4

none
खर्च
$0.004
वेळ
26.7s
टोकन्स
1,923 tok

#79 GPT-6 Luna

medium
खर्च
$0.002
वेळ
23.6s
टोकन्स
2,966 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Mistral Large 4 5.4 7.8 22.2% 1 153.02s 7,431 62,517 0
GPT-6 Luna 6.6 4.6 77.8% 2 23.63s 7,302 438 10,222

झटपट तुलना

तुलना जोडी बदला