नेविगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Mistral Large 4 vs GPT-6 Luna

Mistral Large 4 average score में आगे है: 5.5 vs 5.5. GPT-6 Luna की benchmark लागत कम है: $0.026 vs $0.353. GPT-6 Luna तेज है: 20.48s vs 28.46s, pass rates 30.4% vs 40.6%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-06

तुलना किए गए मॉडल

रैंक
#274
कुल आउटपुट टोकन
84,218
प्रतिक्रिया समय (औसत)
28.46s
कुल लागत
$0.353
रैंक
#279
कुल आउटपुट टोकन
6,855
प्रतिक्रिया समय (औसत)
20.48s
कुल लागत
$0.026
अनुशंसित मॉडल GPT-6 Luna

Its score stays close to the best score here (5.5 vs 5.5), while costing about 13.7x less than Mistral Large 4.

विस्तृत तुलना

मेट्रिक Mistral Large 4 Mistral Large 4 none रिलीज़: 2026-10-06 GPT-6 Luna GPT-6 Luna none रिलीज़: 2026-09-23
स्कोर 5.5 5.5
रैंक #274 #279
विश्वसनीयता 9.9 9.9
संगति 8.8 8.2
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 30.4% 40.6%
अस्थिर टेस्ट 4 5
कुल रन 69 69
प्रति परिणाम लागत 7.044 0.367
कुल लागत $0.353 $0.026
इनपुट कीमत $0.680 / 1M $0.100 / 1M
आउटपुट कीमत $2.090 / 1M $0.500 / 1M
कैश पढ़ने की कीमत $0.070 / 1M $0.010 / 1M
कैश लिखने की कीमत लागू नहीं $0.125 / 1M
कुल इनपुट टोकन 259,048 222,357
आउटपुट टोकन 84,218 6,855
रीजनिंग टोकन 0 0
प्रतिक्रिया समय (औसत) 28.46s 20.48s
प्रतिक्रिया समय (अधिकतम) 385.10s 98.62s
प्रतिक्रिया समय (कुल) 654.47s 470.96s
पैरामीटर 1.05T कुल (49B सक्रिय) ~400B कुल (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#274 Mistral Large 4

none
लागत
$0.004
समय
26.7s
टोकन
1,923 tok

#279 GPT-6 Luna

none
लागत
$0.002
समय
26.0s
टोकन
3,235 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Mistral Large 4 5.4 7.8 22.2% 1 153.02s 7,431 62,517 0
GPT-6 Luna 5.5 10.0 33.3% 0 8.04s 7,302 376 0

त्वरित तुलना

तुलना जोड़ी बदलें