नेव्हिगेशन
AI BENCHY
Advertise here

Mistral Small 4 (medium) vs Qwen3.5-9B

average score जवळपास समान आहे: 5.1 vs 5.1. Qwen3.5-9B चा benchmark खर्च कमी आहे: $0.021 vs $0.096. Mistral Small 4 (medium) वेगवान आहे: 10.77s vs 19.17s, pass rates 42.4% vs 19.7%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-28

क्रमांक
#187
एकूण आउटपुट टोकन्स
131,824
प्रतिसाद वेळ (सरासरी)
10.77s
एकूण खर्च
$0.096
क्रमांक
#189
एकूण आउटपुट टोकन्स
37,484
प्रतिसाद वेळ (सरासरी)
19.17s
एकूण खर्च
$0.021
शिफारस केलेले मॉडेल Mistral Small 4 (medium)

It has the best score here (5.1), while responding about 1.8x faster than Qwen3.5-9B.

तपशीलवार तुलना

मेट्रिक Mistral Small 4 Mistral Small 4 medium प्रकाशन: 2026-03-16 Qwen3.5-9B Qwen3.5-9B none प्रकाशन: 2026-03-02
स्कोअर 5.1 5.1
क्रमांक #187 #189
विश्वसनीयता 10.0 10.0
सुसंगतता 7.0 9.7
बरोबर चाचण्या
प्रति प्रयत्न पास दर 42.4% 19.7%
अस्थिर चाचण्या 8 1
एकूण रन 66 66
प्रति निकाल खर्च 1.913 0.490
एकूण खर्च $0.096 $0.021
इनपुट किंमत $0.150 / 1M $0.100 / 1M
आउटपुट किंमत $0.600 / 1M $0.150 / 1M
एकूण इनपुट टोकन्स 140,494 144,407
आउटपुट टोकन्स 39,462 37,484
रिझनिंग टोकन्स 92,362 0
प्रतिसाद वेळ (सरासरी) 10.77s 19.17s
प्रतिसाद वेळ (कमाल) 59.15s 382.06s
प्रतिसाद वेळ (एकूण) 236.94s 421.74s

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#187 Mistral Small 4

medium
खर्च
$0.006
वेळ
47.9s
टोकन्स
9,857 tok

#189 Qwen3.5-9B

none
अवैध SVG
खर्च
$0.000
वेळ
300.0s
टोकन्स
0 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Mistral Small 4 4.4 5.1 33.3% 2 39.98s 7,636 11,635 54,715
Qwen3.5-9B 3.9 7.8 11.1% 1 5.60s 7,913 1,042 0

झटपट तुलना

तुलना जोडी बदला