नेव्हिगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Mistral Large 4 (low) vs Qwen3.8 Flash Next (medium)

average score जवळपास समान आहे: 7.6 vs 7.6. Qwen3.8 Flash Next (medium) चा benchmark खर्च कमी आहे: ~$0.047 vs $1.648. Qwen3.8 Flash Next (medium) वेगवान आहे: 24.79s vs 300.15s, pass rates 65.2% vs 75.4%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-06

तुलना केलेली मॉडेल्स

क्रमांक
#119
एकूण आउटपुट टोकन्स
714,287
प्रतिसाद वेळ (सरासरी)
300.15s
एकूण खर्च
$1.648
क्रमांक
#120
एकूण आउटपुट टोकन्स
143,965
प्रतिसाद वेळ (सरासरी)
24.79s
एकूण खर्च
~$0.047
शिफारस केलेले मॉडेल Qwen3.8 Flash Next (medium)

It has the best score here (7.6), while costing about 35.1x less than Mistral Large 4 (low).

तपशीलवार तुलना

मेट्रिक Mistral Large 4 Mistral Large 4 low प्रकाशन: 2026-10-06 Qwen3.8 Flash Next Qwen3.8 Flash Next medium प्रकाशन: 2026-10-04
स्कोअर 7.6 7.6
क्रमांक #119 #120
विश्वसनीयता 9.0 10.0
सुसंगतता 8.7 7.9
प्रयत्न 69/69 69/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 65.2% 75.4%
अस्थिर चाचण्या 4 6
एकूण रन 69 69
प्रति निकाल खर्च 12.670 ~0.314
एकूण खर्च $1.648 ~$0.047
इनपुट किंमत $0.680 / 1M लागू नाही
आउटपुट किंमत $2.090 / 1M लागू नाही
कॅश वाचण्याची किंमत $0.070 / 1M लागू नाही
कॅश लिहिण्याची किंमत लागू नाही लागू नाही
एकूण इनपुट टोकन्स 226,734 278,792
आउटपुट टोकन्स 278,013 1,695
रिझनिंग टोकन्स 638,296 142,270
प्रतिसाद वेळ (सरासरी) 300.15s 24.79s
प्रतिसाद वेळ (कमाल) 1798.01s 159.62s
प्रतिसाद वेळ (एकूण) 6903.40s 570.26s
पॅरामीटर्स 1.05T एकूण (49B सक्रिय) 180B एकूण (6B सक्रिय)
उपलब्धता बंद स्रोत वेट्स उपलब्ध

कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#119 Mistral Large 4

low
खर्च
$0.015
वेळ
115.1s
टोकन्स
6,915 tok

#120 Qwen3.8 Flash Next

medium
खर्च
~$0.002
वेळ
40.7s
टोकन्स
4,059 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Mistral Large 4 3.4 7.2 22.2% 1 1379.72s 5,896 129,426 386,126
Qwen3.8 Flash Next 10.0 10.0 100.0% 0 45.53s 7,893 346 37,643

झटपट तुलना

तुलना जोडी बदला

GPT-6 LunalowvsQwen3.8 Flash NextmediumQwen3.8 Flash NextmediumvsSpace Bunny AlphahighMistral Large 4lowvsSpace Bunny AlphahighMistral Large 4lowvsGLM 5.1mediumMistral Large 4highvsQwen3.8 Flash NextmediumSeed-2.0-MinimediumvsMistral Large 4lowMuse Glimmer 30BmediumvsMistral Large 4lowSeed-2.0-CodehighvsQwen3.8 Flash NextmediumMistral Large 4lowvsQwen3.5 Plus 2026-04-20mediumMuse Glimmer 30BhighvsMistral Large 4lowMistral Large 4lowvsGPT-6 LunahighSeed-2.0-CodehighvsMistral Large 4low