نیویگیشن
AI BENCHY
Advertise here

AI BENCHY Compare

Mistral: Mistral Small 4 vs MoonshotAI: Kimi K2.5

خلاصہ

Mistral Small 4 vs Kimi K2.5 benchmark موازنہ: Kimi K2.5 average score میں آگے ہے: 5.5 vs 5.1. Kimi K2.5 کی benchmark لاگت کم ہے: $0.028 vs $0.068. Mistral Small 4 تیز ہے: 9.40s vs 13.18s، pass rates 44.4% vs 34.9%.

تجویز کردہ ماڈل: Kimi K2.5 - It has the best score here (5.5), while costing about 2.5x less than Mistral Small 4.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-06-12

میٹرک Mistral Small 4 Mistral Small 4 medium اجرا: 2026-03-16 Kimi K2.5 Kimi K2.5 none اجرا: 2026-01-27
اسکور 5.1 5.5
درجہ #138 #121
اعتماد پذیری 10.0 10.0
تسلسل 6.9 8.9
درست ٹیسٹس
فی کوشش کامیابی کی شرح 44.4% 34.9%
غیر مستحکم ٹیسٹ 8 3
کل رنز 63 63
فی نتیجہ لاگت 1.344 0.442
کل لاگت $0.068 $0.028
ان پٹ قیمت $0.150 / 1M $0.400 / 1M
آؤٹ پٹ قیمت $0.600 / 1M $1.900 / 1M
کل ان پٹ ٹوکنز 42,576 36,034
آؤٹ پٹ ٹوکنز 24,184 6,657
ریزننگ ٹوکنز 84,678 0
ردِعمل کا وقت (اوسط) 9.40s 13.18s
ردِعمل کا وقت (زیادہ سے زیادہ) 59.15s 42.13s
ردِعمل کا وقت (کل) 197.39s 184.47s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#138 Mistral Small 4

medium
Cost
$0.006
Time
47.9s
Tokens
9,857 tok

#121 MoonshotAI: Kimi K2.5

none
Cost
$0.015
Time
89.1s
Tokens
5,421 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Mistral Small 4 5.6 3.8 66.7% 3 2.67s 708 4,055 4,778
Kimi K2.5 3.6 8.4 8.3% 1 6.24s 652 373 0
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Mistral Small 4 4.4 5.1 33.3% 2 39.98s 7,636 11,635 54,715
Kimi K2.5 5.5 10.0 33.3% 0 24.56s 7,311 4,708 0
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Mistral Small 4 3.0 10.0 0.0% 0 25.25s 18,706 2,612 10,700
Kimi K2.5 2.8 2.1 33.3% 1 19.16s 12,264 748 0
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Mistral Small 4 7.3 5.9 83.3% 1 1.23s 6,171 335 723
Kimi K2.5 7.3 5.8 83.3% 1 42.13s 7,180 187 0
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Mistral Small 4 5.3 7.2 44.4% 1 6.11s 742 2,621 6,904
Kimi K2.5 5.3 10.0 33.3% 0 4.38s 753 29 0
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Mistral Small 4 4.8 10.0 0.0% 0 2.05s 519 821 828
Kimi K2.5 10.0 10.0 100.0% 0 4.00s 483 76 0
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Mistral Small 4 7.3 5.8 83.3% 1 1.38s 729 540 1,031
Kimi K2.5 6.5 10.0 50.0% 0 2.67s 677 60 0
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Mistral Small 4 3.4 9.7 0.0% 0 2.17s 735 1,226 2,632
Kimi K2.5 3.0 10.0 0.0% 0 4.04s 667 236 0
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Mistral Small 4 10.0 10.0 100.0% 0 3.50s 6,420 321 810
Kimi K2.5 10.0 10.0 100.0% 0 13.99s 5,835 220 0
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Mistral Small 4 3.0 10.0 0.0% 0 5.92s 210 18 1,557
Kimi K2.5 3.0 10.0 0.0% 0 3.90s 212 20 0

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں