नेव्हिगेशन
Advertise here

Mistral Large 4 (low) vs GPT-6 Luna (low)

average score जवळपास समान आहे: 7.6 vs 7.6. GPT-6 Luna (low) चा benchmark खर्च कमी आहे: $0.033 vs $1.648. GPT-6 Luna (low) वेगवान आहे: 23.23s vs 300.15s, pass rates 65.2% vs 63.8%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-06

तुलना केलेली मॉडेल्स

क्रमांक
#119
एकूण आउटपुट टोकन्स
714,287
प्रतिसाद वेळ (सरासरी)
300.15s
एकूण खर्च
$1.648
क्रमांक
#121
एकूण आउटपुट टोकन्स
24,880
प्रतिसाद वेळ (सरासरी)
23.23s
एकूण खर्च
$0.033
शिफारस केलेले मॉडेल GPT-6 Luna (low)

It has the best score here (7.6), while costing about 51.4x less than Mistral Large 4 (low).

तपशीलवार तुलना

मेट्रिक Mistral Large 4 Mistral Large 4 low प्रकाशन: 2026-10-06 GPT-6 Luna GPT-6 Luna low प्रकाशन: 2026-09-23
स्कोअर 7.6 7.6
क्रमांक #119 #121
विश्वसनीयता 9.0 9.7
सुसंगतता 8.7 8.5
प्रयत्न 69/69 69/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 65.2% 63.8%
अस्थिर चाचण्या 4 4
एकूण रन 69 69
प्रति निकाल खर्च 12.670 0.267
एकूण खर्च $1.648 $0.033
इनपुट किंमत $0.680 / 1M $0.100 / 1M
आउटपुट किंमत $2.090 / 1M $0.500 / 1M
कॅश वाचण्याची किंमत $0.070 / 1M $0.010 / 1M
कॅश लिहिण्याची किंमत लागू नाही $0.125 / 1M
एकूण इनपुट टोकन्स 226,734 195,928
आउटपुट टोकन्स 278,013 5,728
रिझनिंग टोकन्स 638,296 19,152
प्रतिसाद वेळ (सरासरी) 300.15s 23.23s
प्रतिसाद वेळ (कमाल) 1798.01s 89.37s
प्रतिसाद वेळ (एकूण) 6903.40s 534.22s
पॅरामीटर्स 1.05T एकूण (49B सक्रिय) ~400B एकूण (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#119 Mistral Large 4

low
खर्च
$0.015
वेळ
115.1s
टोकन्स
6,915 tok

#121 GPT-6 Luna

low
खर्च
$0.002
वेळ
19.2s
टोकन्स
2,598 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Mistral Large 4 3.4 7.2 22.2% 1 1379.72s 5,896 129,426 386,126
GPT-6 Luna 6.0 7.2 55.6% 1 15.39s 7,302 493 6,655

झटपट तुलना

तुलना जोडी बदला