نیویگیشن
AI BENCHY
Advertise here

AI BENCHY Compare

Mistral: Mistral Small 4 vs OpenAI: GPT-5.4

خلاصہ

Mistral Small 4 vs GPT-5.4 benchmark موازنہ: GPT-5.4 average score میں آگے ہے: 5.8 vs 5.1. Mistral Small 4 کی benchmark لاگت کم ہے: $0.068 vs $0.122. GPT-5.4 تیز ہے: 1.42s vs 9.40s، pass rates 44.4% vs 36.5%.

تجویز کردہ ماڈل: GPT-5.4 - It has the best score here (5.8), while responding about 6.6x faster than Mistral Small 4.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-06-12

میٹرک Mistral Small 4 Mistral Small 4 medium اجرا: 2026-03-16 GPT-5.4 GPT-5.4 none اجرا: 2026-03-05
اسکور 5.1 5.8
درجہ #138 #116
اعتماد پذیری 10.0 10.0
تسلسل 6.9 9.2
درست ٹیسٹس
فی کوشش کامیابی کی شرح 44.4% 36.5%
غیر مستحکم ٹیسٹ 8 2
کل رنز 63 63
فی نتیجہ لاگت 1.344 1.740
کل لاگت $0.068 $0.122
ان پٹ قیمت $0.150 / 1M $2.500 / 1M
آؤٹ پٹ قیمت $0.600 / 1M $15.000 / 1M
کل ان پٹ ٹوکنز 42,576 34,212
آؤٹ پٹ ٹوکنز 24,184 2,417
ریزننگ ٹوکنز 84,678 0
ردِعمل کا وقت (اوسط) 9.40s 1.42s
ردِعمل کا وقت (زیادہ سے زیادہ) 59.15s 2.95s
ردِعمل کا وقت (کل) 197.39s 29.87s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#138 Mistral Small 4

medium
Cost
$0.006
Time
47.9s
Tokens
9,857 tok

#116 GPT-5.4

none
Cost
$0.026
Time
18.1s
Tokens
1,792 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Mistral Small 4 5.6 3.8 66.7% 3 2.67s 708 4,055 4,778
GPT-5.4 3.2 8.0 8.3% 1 1.21s 606 406 0
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Mistral Small 4 4.4 5.1 33.3% 2 39.98s 7,636 11,635 54,715
GPT-5.4 5.5 10.0 33.3% 0 1.62s 7,305 516 0
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Mistral Small 4 3.0 10.0 0.0% 0 25.25s 18,706 2,612 10,700
GPT-5.4 3.0 10.0 0.0% 0 2.89s 11,019 291 0
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Mistral Small 4 7.3 5.9 83.3% 1 1.23s 6,171 335 723
GPT-5.4 10.0 10.0 100.0% 0 1.04s 7,140 222 0
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Mistral Small 4 5.3 7.2 44.4% 1 6.11s 742 2,621 6,904
GPT-5.4 5.3 7.2 44.4% 1 1.07s 723 50 0
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Mistral Small 4 4.8 10.0 0.0% 0 2.05s 519 821 828
GPT-5.4 4.4 9.9 0.0% 0 1.78s 477 184 0
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Mistral Small 4 7.3 5.8 83.3% 1 1.38s 729 540 1,031
GPT-5.4 6.5 10.0 50.0% 0 1.07s 660 81 0
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Mistral Small 4 3.4 9.7 0.0% 0 2.17s 735 1,226 2,632
GPT-5.4 5.6 9.8 33.3% 0 1.44s 642 381 0
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Mistral Small 4 10.0 10.0 100.0% 0 3.50s 6,420 321 810
GPT-5.4 10.0 10.0 100.0% 0 2.75s 5,445 246 0
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Mistral Small 4 3.0 10.0 0.0% 0 5.92s 210 18 1,557
GPT-5.4 3.0 10.0 0.0% 0 990ms 195 40 0

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں