نیویگیشن
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 3.1 Flash Lite vs Mistral: Mistral Small 4

خلاصہ

Gemini 3.1 Flash Lite vs Mistral Small 4 benchmark موازنہ: Gemini 3.1 Flash Lite average score میں آگے ہے: 6.1 vs 5.1. Mistral Small 4 کی benchmark لاگت کم ہے: $0.007 vs $0.013. Mistral Small 4 تیز ہے: 630ms vs 1.33s، pass rates 54.0% vs 27.0%.

تجویز کردہ ماڈل: Mistral Small 4 - It offers the best overall trade-off: a competitive score (5.1), lower cost than Gemini 3.1 Flash Lite, and balanced response time.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-06-12

میٹرک Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite minimal اجرا: 2026-05-08 Mistral Small 4 Mistral Small 4 none اجرا: 2026-03-16
اسکور 6.1 5.1
درجہ #95 #136
اعتماد پذیری 10.0 10.0
تسلسل 8.8 9.5
درست ٹیسٹس
فی کوشش کامیابی کی شرح 54.0% 27.0%
غیر مستحکم ٹیسٹ 3 1
کل رنز 63 63
فی نتیجہ لاگت 0.130 0.139
کل لاگت $0.013 $0.007
ان پٹ قیمت $0.250 / 1M $0.150 / 1M
آؤٹ پٹ قیمت $1.500 / 1M $0.600 / 1M
کل ان پٹ ٹوکنز 36,973 37,309
آؤٹ پٹ ٹوکنز 2,487 2,201
ریزننگ ٹوکنز 0 0
ردِعمل کا وقت (اوسط) 1.33s 630ms
ردِعمل کا وقت (زیادہ سے زیادہ) 4.49s 1.72s
ردِعمل کا وقت (کل) 27.91s 13.22s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#95 Gemini 3.1 Flash Lite

minimal
Cost
$0.001
Time
3.7s
Tokens
635 tok

#136 Mistral Small 4

none
Cost
$0.002
Time
10.4s
Tokens
2,370 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Flash Lite 8.3 10.0 75.0% 0 1.10s 500 639 0
Mistral Small 4 3.4 7.9 16.7% 1 395ms 708 182 0
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Flash Lite 5.5 10.0 33.3% 0 831ms 8,126 666 0
Mistral Small 4 3.7 9.7 0.0% 0 901ms 7,636 619 0
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Flash Lite 3.0 10.0 0.0% 0 2.53s 12,870 357 0
Mistral Small 4 3.0 10.0 0.0% 0 1.72s 11,640 496 0
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 1.04s 7,552 279 0
Mistral Small 4 10.0 10.0 100.0% 0 822ms 7,914 261 0
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Flash Lite 2.9 7.2 11.1% 1 1.02s 641 15 0
Mistral Small 4 5.3 10.0 33.3% 0 367ms 798 28 0
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Flash Lite 4.0 10.0 0.0% 0 791ms 490 63 0
Mistral Small 4 4.0 10.0 0.0% 0 729ms 519 205 0
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 932ms 615 72 0
Mistral Small 4 6.5 10.0 50.0% 0 380ms 729 69 0
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Flash Lite 6.0 4.6 66.7% 2 2.15s 564 153 0
Mistral Small 4 3.1 9.9 0.0% 0 399ms 735 111 0
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 3.51s 5,457 234 0
Mistral Small 4 10.0 10.0 100.0% 0 1.40s 6,420 213 0
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Flash Lite 3.0 10.0 0.0% 0 724ms 158 9 0
Mistral Small 4 3.0 10.0 0.0% 0 397ms 210 17 0

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں