नेव्हिगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Mistral Large 4 vs GPT-6 Luna

Mistral Large 4 average score मध्ये पुढे आहे: 5.5 vs 5.5. GPT-6 Luna चा benchmark खर्च कमी आहे: $0.026 vs $0.353. GPT-6 Luna वेगवान आहे: 20.48s vs 28.46s, pass rates 30.4% vs 40.6%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-06

तुलना केलेली मॉडेल्स

क्रमांक
#274
एकूण आउटपुट टोकन्स
84,218
प्रतिसाद वेळ (सरासरी)
28.46s
एकूण खर्च
$0.353
क्रमांक
#279
एकूण आउटपुट टोकन्स
6,855
प्रतिसाद वेळ (सरासरी)
20.48s
एकूण खर्च
$0.026
शिफारस केलेले मॉडेल GPT-6 Luna

Its score stays close to the best score here (5.5 vs 5.5), while costing about 13.7x less than Mistral Large 4.

तपशीलवार तुलना

मेट्रिक Mistral Large 4 Mistral Large 4 none प्रकाशन: 2026-10-06 GPT-6 Luna GPT-6 Luna none प्रकाशन: 2026-09-23
स्कोअर 5.5 5.5
क्रमांक #274 #279
विश्वसनीयता 9.9 9.9
सुसंगतता 8.8 8.2
प्रयत्न 69/69 69/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 30.4% 40.6%
अस्थिर चाचण्या 4 5
एकूण रन 69 69
प्रति निकाल खर्च 7.044 0.367
एकूण खर्च $0.353 $0.026
इनपुट किंमत $0.680 / 1M $0.100 / 1M
आउटपुट किंमत $2.090 / 1M $0.500 / 1M
कॅश वाचण्याची किंमत $0.070 / 1M $0.010 / 1M
कॅश लिहिण्याची किंमत लागू नाही $0.125 / 1M
एकूण इनपुट टोकन्स 259,048 222,357
आउटपुट टोकन्स 84,218 6,855
रिझनिंग टोकन्स 0 0
प्रतिसाद वेळ (सरासरी) 28.46s 20.48s
प्रतिसाद वेळ (कमाल) 385.10s 98.62s
प्रतिसाद वेळ (एकूण) 654.47s 470.96s
पॅरामीटर्स 1.05T एकूण (49B सक्रिय) ~400B एकूण (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#274 Mistral Large 4

none
खर्च
$0.004
वेळ
26.7s
टोकन्स
1,923 tok

#279 GPT-6 Luna

none
खर्च
$0.002
वेळ
26.0s
टोकन्स
3,235 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Mistral Large 4 5.4 7.8 22.2% 1 153.02s 7,431 62,517 0
GPT-6 Luna 5.5 10.0 33.3% 0 8.04s 7,302 376 0

झटपट तुलना

तुलना जोडी बदला