نیویگیشن
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemma 4 31B vs MoonshotAI: Kimi K2.6

خلاصہ

Gemma 4 31B vs Kimi K2.6 benchmark موازنہ: Gemma 4 31B average score میں آگے ہے: 6.3 vs 5.8. Gemma 4 31B کی benchmark لاگت کم ہے: $0.033 vs $0.079. Kimi K2.6 تیز ہے: 13.27s vs 56.55s، pass rates 69.8% vs 36.5%.

تجویز کردہ ماڈل: Gemma 4 31B - It has the best score here (6.3), while costing about 2.4x less than Kimi K2.6.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-06-12

میٹرک Gemma 4 31B Gemma 4 31B medium اجرا: 2026-04-02 مفت دستیاب Kimi K2.6 Kimi K2.6 none اجرا: 2026-04-20 مفت دستیاب
اسکور 6.3 5.8
درجہ #87 #115
اعتماد پذیری 10.0 10.0
تسلسل 9.4 9.2
درست ٹیسٹس
فی کوشش کامیابی کی شرح 69.8% 36.5%
غیر مستحکم ٹیسٹ 1 2
کل رنز 63 63
فی نتیجہ لاگت 0.257 1.267
کل لاگت $0.033 $0.079
ان پٹ قیمت $0.120 / 1M $0.680 / 1M
آؤٹ پٹ قیمت $0.350 / 1M $3.410 / 1M
کل ان پٹ ٹوکنز 17,957 32,916
آؤٹ پٹ ٹوکنز 22,356 16,410
ریزننگ ٹوکنز 65,726 0
ردِعمل کا وقت (اوسط) 56.55s 13.27s
ردِعمل کا وقت (زیادہ سے زیادہ) 437.40s 238.89s
ردِعمل کا وقت (کل) 1074.41s 278.57s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#87 Gemma 4 31B

medium
Cost
$0.002
Time
45.7s
Tokens
2,696 tok

#115 MoonshotAI: Kimi K2.6

none
Cost
$0.020
Time
127.4s
Tokens
4,429 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemma 4 31B 10.0 10.0 100.0% 0 12.89s 816 962 2,046
Kimi K2.6 4.6 10.0 25.0% 0 1.39s 618 471 0
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemma 4 31B 4.3 5.8 22.2% 1 219.76s 5,568 11,098 33,212
Kimi K2.6 5.5 9.8 33.3% 0 82.57s 5,986 14,754 0
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemma 4 31B 3.0 10.0 0.0% 0 0ms 0 0 0
Kimi K2.6 3.0 10.0 0.0% 0 3.38s 11,269 290 0
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemma 4 31B 10.0 10.0 100.0% 0 21.11s 8,334 1,822 2,951
Kimi K2.6 10.0 10.0 100.0% 0 1.32s 7,014 201 0
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemma 4 31B 7.7 10.0 66.7% 0 38.48s 876 4,349 8,985
Kimi K2.6 5.3 7.2 44.4% 1 1.48s 732 42 0
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemma 4 31B 10.0 10.0 100.0% 0 9.57s 567 105 888
Kimi K2.6 5.4 3.5 33.3% 1 1.55s 477 138 0
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemma 4 31B 10.0 10.0 100.0% 0 12.76s 777 533 2,035
Kimi K2.6 6.5 10.0 50.0% 0 1.64s 669 72 0
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemma 4 31B 9.9 10.0 100.0% 0 26.91s 801 1,795 5,595
Kimi K2.6 3.1 9.9 0.0% 0 1.40s 651 185 0
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemma 4 31B 3.0 10.0 0.0% 0 0ms 0 0 0
Kimi K2.6 10.0 10.0 100.0% 0 4.46s 5,286 240 0
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemma 4 31B 3.0 10.0 0.0% 0 90.14s 218 1,692 10,014
Kimi K2.6 3.0 10.0 0.0% 0 1.36s 214 17 0

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں