नेव्हिगेशन
AI BENCHY
Advertise here

Mistral Small 4 (medium) vs Qwen3 Coder Next

average score जवळपास समान आहे: 5.1 vs 5.1. Qwen3 Coder Next चा benchmark खर्च कमी आहे: $0.026 vs $0.096. Qwen3 Coder Next वेगवान आहे: 9.12s vs 10.77s, pass rates 42.4% vs 25.8%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-28

क्रमांक
#187
एकूण आउटपुट टोकन्स
131,824
प्रतिसाद वेळ (सरासरी)
10.77s
एकूण खर्च
$0.096
क्रमांक
#186
एकूण आउटपुट टोकन्स
11,808
प्रतिसाद वेळ (सरासरी)
9.12s
एकूण खर्च
$0.026
शिफारस केलेले मॉडेल Qwen3 Coder Next

It has the best score here (5.1), while costing about 3.7x less than Mistral Small 4 (medium).

तपशीलवार तुलना

मेट्रिक Mistral Small 4 Mistral Small 4 medium प्रकाशन: 2026-03-16 Qwen3 Coder Next Qwen3 Coder Next none प्रकाशन: 2026-02-03
स्कोअर 5.1 5.1
क्रमांक #187 #186
विश्वसनीयता 10.0 10.0
सुसंगतता 7.0 9.7
बरोबर चाचण्या
प्रति प्रयत्न पास दर 42.4% 25.8%
अस्थिर चाचण्या 8 1
एकूण रन 66 66
प्रति निकाल खर्च 1.913 0.488
एकूण खर्च $0.096 $0.026
इनपुट किंमत $0.150 / 1M $0.120 / 1M
आउटपुट किंमत $0.600 / 1M $0.800 / 1M
एकूण इनपुट टोकन्स 140,494 134,218
आउटपुट टोकन्स 39,462 11,808
रिझनिंग टोकन्स 92,362 0
प्रतिसाद वेळ (सरासरी) 10.77s 9.12s
प्रतिसाद वेळ (कमाल) 59.15s 45.14s
प्रतिसाद वेळ (एकूण) 236.94s 145.94s

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#187 Mistral Small 4

medium
खर्च
$0.006
वेळ
47.9s
टोकन्स
9,857 tok

#186 Qwen3 Coder Next

none
अवैध SVG
खर्च
$0.058
वेळ
246.3s
टोकन्स
64,126 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Mistral Small 4 4.4 5.1 33.3% 2 39.98s 7,636 11,635 54,715
Qwen3 Coder Next 4.6 7.9 22.2% 1 2.22s 7,442 621 0

झटपट तुलना

तुलना जोडी बदला