नेव्हिगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Mistral Large 4 (high) vs GPT-6 Luna (high)

GPT-6 Luna (high) average score मध्ये पुढे आहे: 7.7 vs 7.5. GPT-6 Luna (high) चा benchmark खर्च कमी आहे: $0.074 vs $1.391. GPT-6 Luna (high) वेगवान आहे: 20.37s vs 263.69s, pass rates 65.2% vs 73.9%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-07

तुलना केलेली मॉडेल्स

क्रमांक
#125
एकूण आउटपुट टोकन्स
590,306
प्रतिसाद वेळ (सरासरी)
263.69s
एकूण खर्च
$1.391
क्रमांक
#114
एकूण आउटपुट टोकन्स
101,587
प्रतिसाद वेळ (सरासरी)
20.37s
एकूण खर्च
$0.074
शिफारस केलेले मॉडेल GPT-6 Luna (high)

It has the best score here (7.7), while costing about 18.8x less than Mistral Large 4 (high).

तपशीलवार तुलना

मेट्रिक Mistral Large 4 Mistral Large 4 high प्रकाशन: 2026-10-06 GPT-6 Luna GPT-6 Luna high प्रकाशन: 2026-09-23
स्कोअर 7.5 7.7
क्रमांक #125 #114
विश्वसनीयता 9.0 10.0
सुसंगतता 7.9 8.7
प्रयत्न 69/69 69/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 65.2% 73.9%
अस्थिर चाचण्या 6 4
एकूण रन 69 69
प्रति निकाल खर्च 11.590 0.492
एकूण खर्च $1.391 $0.074
इनपुट किंमत $0.680 / 1M $0.100 / 1M
आउटपुट किंमत $2.090 / 1M $0.500 / 1M
कॅश वाचण्याची किंमत $0.070 / 1M $0.010 / 1M
कॅश लिहिण्याची किंमत लागू नाही $0.125 / 1M
एकूण इनपुट टोकन्स 230,895 229,986
आउटपुट टोकन्स 161,281 6,037
रिझनिंग टोकन्स 510,655 95,550
प्रतिसाद वेळ (सरासरी) 263.69s 20.37s
प्रतिसाद वेळ (कमाल) 1727.29s 106.93s
प्रतिसाद वेळ (एकूण) 6064.89s 468.52s
पॅरामीटर्स 1.05T एकूण (49B सक्रिय) ~400B एकूण (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#125 Mistral Large 4

high
खर्च
$0.007
वेळ
53.3s
टोकन्स
3,333 tok

#114 GPT-6 Luna

high
खर्च
$0.003
वेळ
49.2s
टोकन्स
5,231 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Mistral Large 4 3.3 4.4 33.3% 2 1277.83s 6,541 53,820 279,694
GPT-6 Luna 7.8 7.4 77.8% 1 24.69s 7,302 483 15,691

झटपट तुलना

तुलना जोडी बदला