नेविगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Mistral Large 4 (medium) vs Qwen3.5 Plus 2026-04-20

Mistral Large 4 (medium) average score में आगे है: 6.2 vs 6.1. Qwen3.5 Plus 2026-04-20 की benchmark लागत कम है: $0.216 vs $1.456. Qwen3.5 Plus 2026-04-20 तेज है: 18.49s vs 265.03s, pass rates 55.1% vs 44.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-06

तुलना किए गए मॉडल

रैंक
#240
कुल आउटपुट टोकन
627,233
प्रतिक्रिया समय (औसत)
265.03s
कुल लागत
$1.456
रैंक
#245
कुल आउटपुट टोकन
69,664
प्रतिक्रिया समय (औसत)
18.49s
कुल लागत
$0.216
अनुशंसित मॉडल Qwen3.5 Plus 2026-04-20

Its score stays close to the best score here (6.1 vs 6.2), while costing about 6.8x less than Mistral Large 4 (medium).

विस्तृत तुलना

मेट्रिक Mistral Large 4 Mistral Large 4 medium रिलीज़: 2026-10-06 Qwen3.5 Plus 2026-04-20 Qwen3.5 Plus 2026-04-20 none रिलीज़: 2026-04-20
स्कोर 6.2 6.1
रैंक #240 #245
विश्वसनीयता 9.2 9.8
संगति 7.6 8.4
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 55.1% 44.9%
अस्थिर टेस्ट 7 5
कुल रन 69 69
प्रति परिणाम लागत 16.168 2.816
कुल लागत $1.456 $0.216
इनपुट कीमत $0.680 / 1M $0.300 / 1M
आउटपुट कीमत $2.090 / 1M $1.800 / 1M
कैश पढ़ने की कीमत $0.070 / 1M लागू नहीं
कैश लिखने की कीमत लागू नहीं $0.375 / 1M
कुल इनपुट टोकन 212,024 299,984
आउटपुट टोकन 166,422 69,664
रीजनिंग टोकन 562,095 0
प्रतिक्रिया समय (औसत) 265.03s 18.49s
प्रतिक्रिया समय (अधिकतम) 1760.20s 206.05s
प्रतिक्रिया समय (कुल) 6095.69s 425.33s
पैरामीटर 1.05T कुल (49B सक्रिय) ~397B कुल (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#240 Mistral Large 4

medium
लागत
$0.011
समय
63.4s
टोकन
5,291 tok

#245 Qwen3.5 Plus 2026-04-20

none
लागत
$0.008
समय
77.0s
टोकन
4,369 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Mistral Large 4 3.4 7.2 22.2% 1 1201.87s 7,189 33,530 303,140
Qwen3.5 Plus 2026-04-20 3.9 7.8 11.1% 1 1.69s 7,913 480 0

त्वरित तुलना

तुलना जोड़ी बदलें