नेविगेशन
Advertise here

Mistral Large 4 (high) vs GPT-6 Luna (medium)

GPT-6 Luna (medium) average score में आगे है: 8.3 vs 7.5. GPT-6 Luna (medium) की benchmark लागत कम है: $0.047 vs $1.391. GPT-6 Luna (medium) तेज है: 18.07s vs 263.69s, pass rates 65.2% vs 73.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-06

तुलना किए गए मॉडल

रैंक
#126
कुल आउटपुट टोकन
590,306
प्रतिक्रिया समय (औसत)
263.69s
कुल लागत
$1.391
रैंक
#79
कुल आउटपुट टोकन
53,161
प्रतिक्रिया समय (औसत)
18.07s
कुल लागत
$0.047
अनुशंसित मॉडल GPT-6 Luna (medium)

It has the best score here (8.3), while costing about 29.7x less than Mistral Large 4 (high).

विस्तृत तुलना

मेट्रिक Mistral Large 4 Mistral Large 4 high रिलीज़: 2026-10-06 GPT-6 Luna GPT-6 Luna medium रिलीज़: 2026-09-23
स्कोर 7.5 8.3
रैंक #126 #79
विश्वसनीयता 9.0 10.0
संगति 7.9 8.9
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 65.2% 73.9%
अस्थिर टेस्ट 6 3
कुल रन 69 69
प्रति परिणाम लागत 11.590 0.313
कुल लागत $1.391 $0.047
इनपुट कीमत $0.680 / 1M $0.100 / 1M
आउटपुट कीमत $2.090 / 1M $0.500 / 1M
कैश पढ़ने की कीमत $0.070 / 1M $0.010 / 1M
कैश लिखने की कीमत लागू नहीं $0.125 / 1M
कुल इनपुट टोकन 230,895 203,193
आउटपुट टोकन 161,281 5,751
रीजनिंग टोकन 510,655 47,410
प्रतिक्रिया समय (औसत) 263.69s 18.07s
प्रतिक्रिया समय (अधिकतम) 1727.29s 66.44s
प्रतिक्रिया समय (कुल) 6064.89s 415.53s
पैरामीटर 1.05T कुल (49B सक्रिय) ~400B कुल (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#126 Mistral Large 4

high
लागत
$0.007
समय
53.3s
टोकन
3,333 tok

#79 GPT-6 Luna

medium
लागत
$0.002
समय
23.6s
टोकन
2,966 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Mistral Large 4 3.3 4.4 33.3% 2 1277.83s 6,541 53,820 279,694
GPT-6 Luna 6.6 4.6 77.8% 2 23.63s 7,302 438 10,222

त्वरित तुलना

तुलना जोड़ी बदलें