نیویگیشن
AI BENCHY
Advertise here

Mistral Small 4 (medium) vs Qwen3.5-9B

average score تقریباً برابر ہے: 5.1 vs 5.1. Qwen3.5-9B کی benchmark لاگت کم ہے: $0.021 vs $0.096. Mistral Small 4 (medium) تیز ہے: 10.77s vs 19.17s، pass rates 42.4% vs 19.7%.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-07-28

درجہ
#187
کل آؤٹ پٹ ٹوکنز
131,824
ردِعمل کا وقت (اوسط)
10.77s
کل لاگت
$0.096
درجہ
#189
کل آؤٹ پٹ ٹوکنز
37,484
ردِعمل کا وقت (اوسط)
19.17s
کل لاگت
$0.021
تجویز کردہ ماڈل Mistral Small 4 (medium)

It has the best score here (5.1), while responding about 1.8x faster than Qwen3.5-9B.

تفصیلی موازنہ

میٹرک Mistral Small 4 Mistral Small 4 medium اجرا: 2026-03-16 Qwen3.5-9B Qwen3.5-9B none اجرا: 2026-03-02
اسکور 5.1 5.1
درجہ #187 #189
اعتماد پذیری 10.0 10.0
تسلسل 7.0 9.7
درست ٹیسٹس
فی کوشش کامیابی کی شرح 42.4% 19.7%
غیر مستحکم ٹیسٹ 8 1
کل رنز 66 66
فی نتیجہ لاگت 1.913 0.490
کل لاگت $0.096 $0.021
ان پٹ قیمت $0.150 / 1M $0.100 / 1M
آؤٹ پٹ قیمت $0.600 / 1M $0.150 / 1M
کل ان پٹ ٹوکنز 140,494 144,407
آؤٹ پٹ ٹوکنز 39,462 37,484
ریزننگ ٹوکنز 92,362 0
ردِعمل کا وقت (اوسط) 10.77s 19.17s
ردِعمل کا وقت (زیادہ سے زیادہ) 59.15s 382.06s
ردِعمل کا وقت (کل) 236.94s 421.74s

ماڈل جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#187 Mistral Small 4

medium
لاگت
$0.006
وقت
47.9s
ٹوکنز
9,857 tok

#189 Qwen3.5-9B

none
غلط SVG
لاگت
$0.000
وقت
300.0s
ٹوکنز
0 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Mistral Small 4 4.4 5.1 33.3% 2 39.98s 7,636 11,635 54,715
Qwen3.5-9B 3.9 7.8 11.1% 1 5.60s 7,913 1,042 0

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں