नेविगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Mistral Large 4 (high) vs GPT-6 Luna (high)

GPT-6 Luna (high) average score में आगे है: 7.7 vs 7.5. GPT-6 Luna (high) की benchmark लागत कम है: $0.074 vs $1.391. GPT-6 Luna (high) तेज है: 20.37s vs 263.69s, pass rates 65.2% vs 73.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-07

तुलना किए गए मॉडल

रैंक
#125
कुल आउटपुट टोकन
590,306
प्रतिक्रिया समय (औसत)
263.69s
कुल लागत
$1.391
रैंक
#114
कुल आउटपुट टोकन
101,587
प्रतिक्रिया समय (औसत)
20.37s
कुल लागत
$0.074
अनुशंसित मॉडल GPT-6 Luna (high)

It has the best score here (7.7), while costing about 18.8x less than Mistral Large 4 (high).

विस्तृत तुलना

मेट्रिक Mistral Large 4 Mistral Large 4 high रिलीज़: 2026-10-06 GPT-6 Luna GPT-6 Luna high रिलीज़: 2026-09-23
स्कोर 7.5 7.7
रैंक #125 #114
विश्वसनीयता 9.0 10.0
संगति 7.9 8.7
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 65.2% 73.9%
अस्थिर टेस्ट 6 4
कुल रन 69 69
प्रति परिणाम लागत 11.590 0.492
कुल लागत $1.391 $0.074
इनपुट कीमत $0.680 / 1M $0.100 / 1M
आउटपुट कीमत $2.090 / 1M $0.500 / 1M
कैश पढ़ने की कीमत $0.070 / 1M $0.010 / 1M
कैश लिखने की कीमत लागू नहीं $0.125 / 1M
कुल इनपुट टोकन 230,895 229,986
आउटपुट टोकन 161,281 6,037
रीजनिंग टोकन 510,655 95,550
प्रतिक्रिया समय (औसत) 263.69s 20.37s
प्रतिक्रिया समय (अधिकतम) 1727.29s 106.93s
प्रतिक्रिया समय (कुल) 6064.89s 468.52s
पैरामीटर 1.05T कुल (49B सक्रिय) ~400B कुल (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#125 Mistral Large 4

high
लागत
$0.007
समय
53.3s
टोकन
3,333 tok

#114 GPT-6 Luna

high
लागत
$0.003
समय
49.2s
टोकन
5,231 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Mistral Large 4 3.3 4.4 33.3% 2 1277.83s 6,541 53,820 279,694
GPT-6 Luna 7.8 7.4 77.8% 1 24.69s 7,302 483 15,691

त्वरित तुलना

तुलना जोड़ी बदलें