نیویگیشن
AI BENCHY
Advertise here

AI BENCHY Compare

Mistral: Mistral Small 4 vs xAI: Grok 4.20

خلاصہ

Mistral Small 4 vs Grok 4.20 benchmark موازنہ: Mistral Small 4 average score میں آگے ہے: 5.1 vs 4.4. Grok 4.20 کی benchmark لاگت کم ہے: $0.057 vs $0.068. Grok 4.20 تیز ہے: 1.11s vs 9.40s، pass rates 44.4% vs 28.6%.

تجویز کردہ ماڈل: Mistral Small 4 - It has the strongest score in this comparison (5.1) and the best overall balance of cost and response time across all 2 models.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-07-02

میٹرک Mistral Small 4 Mistral Small 4 medium اجرا: 2026-03-16 Grok 4.20 Grok 4.20 none اجرا: 2026-03-31
اسکور 5.1 4.4
درجہ #138 #160
اعتماد پذیری 10.0 دستیاب نہیں
تسلسل 6.9 8.5
درست ٹیسٹس
فی کوشش کامیابی کی شرح 44.4% 28.6%
غیر مستحکم ٹیسٹ 8 0
کل رنز 63 54
فی نتیجہ لاگت 1.344 1.570
کل لاگت $0.068 $0.057
ان پٹ قیمت $0.150 / 1M $1.250 / 1M
آؤٹ پٹ قیمت $0.600 / 1M $2.500 / 1M
کل ان پٹ ٹوکنز 42,576 41,313
آؤٹ پٹ ٹوکنز 24,184 1,923
ریزننگ ٹوکنز 84,678 0
ردِعمل کا وقت (اوسط) 9.40s 1.11s
ردِعمل کا وقت (زیادہ سے زیادہ) 59.15s 6.04s
ردِعمل کا وقت (کل) 197.39s 19.96s

جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#138 Mistral Small 4

medium
لاگت
$0.006
وقت
47.9s
ٹوکنز
9,857 tok

#160 xAI: Grok 4.20

none
لاگت
$0.004
وقت
6.5s
ٹوکنز
1,367 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Mistral Small 4 5.6 3.8 66.7% 3 2.67s 708 4,055 4,778
Grok 4.20 4.8 10.0 25.0% 0 501ms 1,986 267 0
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Mistral Small 4 4.4 5.1 33.3% 2 39.98s 7,636 11,635 54,715
Grok 4.20 1.1 3.1 0.0% 0 1.22s 1,074 312 0
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Mistral Small 4 3.0 10.0 0.0% 0 25.25s 18,706 2,612 10,700
Grok 4.20 3.0 10.0 0.0% 0 6.04s 17,673 282 0
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Mistral Small 4 7.3 5.9 83.3% 1 1.23s 6,171 335 723
Grok 4.20 10.0 10.0 100.0% 0 522ms 7,749 207 0
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Mistral Small 4 5.3 7.2 44.4% 1 6.11s 742 2,621 6,904
Grok 4.20 3.0 10.0 0.0% 0 687ms 1,746 325 0
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Mistral Small 4 4.8 10.0 0.0% 0 2.05s 519 821 828
Grok 4.20 4.8 10.0 0.0% 0 659ms 819 83 0
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Mistral Small 4 7.3 5.8 83.3% 1 1.38s 729 540 1,031
Grok 4.20 6.3 10.0 50.0% 0 445ms 1,350 60 0
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Mistral Small 4 3.4 9.7 0.0% 0 2.17s 735 1,226 2,632
Grok 4.20 5.3 10.0 33.3% 0 473ms 1,671 198 0
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Mistral Small 4 10.0 10.0 100.0% 0 3.50s 6,420 321 810
Grok 4.20 10.0 10.0 100.0% 0 4.63s 7,245 189 0
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Mistral Small 4 3.0 10.0 0.0% 0 5.92s 210 18 1,557
Grok 4.20 0.0 0.0 0.0% 0 0ms 0 0 0

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں