नेविगेशन
Advertise here

Mistral Large 4 (high) vs GPT-6 Luna (low)

GPT-6 Luna (low) average score में आगे है: 7.6 vs 7.5. GPT-6 Luna (low) की benchmark लागत कम है: $0.033 vs $1.391. GPT-6 Luna (low) तेज है: 23.23s vs 263.69s, pass rates 65.2% vs 63.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-06

तुलना किए गए मॉडल

रैंक
#126
कुल आउटपुट टोकन
590,306
प्रतिक्रिया समय (औसत)
263.69s
कुल लागत
$1.391
रैंक
#121
कुल आउटपुट टोकन
24,880
प्रतिक्रिया समय (औसत)
23.23s
कुल लागत
$0.033
अनुशंसित मॉडल GPT-6 Luna (low)

It has the best score here (7.6), while costing about 43.4x less than Mistral Large 4 (high).

विस्तृत तुलना

मेट्रिक Mistral Large 4 Mistral Large 4 high रिलीज़: 2026-10-06 GPT-6 Luna GPT-6 Luna low रिलीज़: 2026-09-23
स्कोर 7.5 7.6
रैंक #126 #121
विश्वसनीयता 9.0 9.7
संगति 7.9 8.5
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 65.2% 63.8%
अस्थिर टेस्ट 6 4
कुल रन 69 69
प्रति परिणाम लागत 11.590 0.267
कुल लागत $1.391 $0.033
इनपुट कीमत $0.680 / 1M $0.100 / 1M
आउटपुट कीमत $2.090 / 1M $0.500 / 1M
कैश पढ़ने की कीमत $0.070 / 1M $0.010 / 1M
कैश लिखने की कीमत लागू नहीं $0.125 / 1M
कुल इनपुट टोकन 230,895 195,928
आउटपुट टोकन 161,281 5,728
रीजनिंग टोकन 510,655 19,152
प्रतिक्रिया समय (औसत) 263.69s 23.23s
प्रतिक्रिया समय (अधिकतम) 1727.29s 89.37s
प्रतिक्रिया समय (कुल) 6064.89s 534.22s
पैरामीटर 1.05T कुल (49B सक्रिय) ~400B कुल (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#126 Mistral Large 4

high
लागत
$0.007
समय
53.3s
टोकन
3,333 tok

#121 GPT-6 Luna

low
लागत
$0.002
समय
19.2s
टोकन
2,598 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Mistral Large 4 3.3 4.4 33.3% 2 1277.83s 6,541 53,820 279,694
GPT-6 Luna 6.0 7.2 55.6% 1 15.39s 7,302 493 6,655

त्वरित तुलना

तुलना जोड़ी बदलें

GPT-6 LunalowvsQwen3.8 Flash NextmediumSeed-2.0-MinimediumvsMistral Large 4highGPT-6 LunalowvsSpace Bunny AlphahighGPT-6 LunalowvsGLM 5.1mediumMistral Large 4highvsGLM 5.1mediumSeed-2.0-MinimediumvsGPT-6 LunalowMistral Large 4highvsQwen3.8 27Blowनिःशुल्क उपलब्धMistral Large 4highvsQwen3.8 Flash NextmediumMistral Large 4highvsGPT-5.6 LunamediumMistral Large 4highvsQwen3.6 FlashmediumDeepSeek V4 Flash 0731lowvsMistral Large 4highSeed-2.0-CodehighvsGPT-6 Lunalow