نیویگیشن
AI BENCHY
Advertise here

AI BENCHY Compare

Google: Gemini 3.1 Flash Lite vs MoonshotAI: Kimi K2.5

خلاصہ

Gemini 3.1 Flash Lite vs Kimi K2.5 benchmark موازنہ: Kimi K2.5 average score میں آگے ہے: 7.5 vs 6.1. Gemini 3.1 Flash Lite کی benchmark لاگت کم ہے: $0.013 vs $0.348. Gemini 3.1 Flash Lite تیز ہے: 1.33s vs 98.43s، pass rates 54.0% vs 68.3%.

تجویز کردہ ماڈل: Gemini 3.1 Flash Lite - It offers the best overall trade-off: a competitive score (6.1), lower cost than Kimi K2.5, and balanced response time.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-06-18

میٹرک Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite minimal اجرا: 2026-05-08 Kimi K2.5 Kimi K2.5 medium اجرا: 2026-01-27
اسکور 6.1 7.5
درجہ #94 #43
اعتماد پذیری 10.0 10.0
تسلسل 8.8 6.9
درست ٹیسٹس
فی کوشش کامیابی کی شرح 54.0% 68.3%
غیر مستحکم ٹیسٹ 3 8
کل رنز 63 63
فی نتیجہ لاگت 0.130 3.704
کل لاگت $0.013 $0.348
ان پٹ قیمت $0.250 / 1M $0.375 / 1M
آؤٹ پٹ قیمت $1.500 / 1M $2.025 / 1M
کل ان پٹ ٹوکنز 36,973 34,312
آؤٹ پٹ ٹوکنز 2,487 48,379
ریزننگ ٹوکنز 0 157,747
ردِعمل کا وقت (اوسط) 1.33s 98.43s
ردِعمل کا وقت (زیادہ سے زیادہ) 4.49s 281.00s
ردِعمل کا وقت (کل) 27.91s 1378.03s

جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#94 Gemini 3.1 Flash Lite

minimal
لاگت
$0.001
وقت
3.7s
ٹوکنز
635 tok

#43 MoonshotAI: Kimi K2.5

medium
لاگت
$0.030
وقت
58.6s
ٹوکنز
8,683 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Flash Lite 8.3 10.0 75.0% 0 1.10s 500 639 0
Kimi K2.5 7.3 5.8 83.3% 2 51.38s 634 2,789 8,880
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Flash Lite 5.5 10.0 33.3% 0 831ms 8,126 666 0
Kimi K2.5 6.1 4.6 66.7% 2 217.49s 6,935 5,705 74,693
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Flash Lite 3.0 10.0 0.0% 0 2.53s 12,870 357 0
Kimi K2.5 10.0 10.0 100.0% 0 71.37s 11,280 703 3,713
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 1.04s 7,552 279 0
Kimi K2.5 10.0 10.0 100.0% 0 49.78s 7,020 563 7,940
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Flash Lite 2.9 7.2 11.1% 1 1.02s 641 15 0
Kimi K2.5 3.5 4.4 33.3% 2 137.29s 485 20,753 30,564
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Flash Lite 4.0 10.0 0.0% 0 791ms 490 63 0
Kimi K2.5 6.5 3.4 66.7% 1 69.73s 480 3,815 4,262
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 932ms 615 72 0
Kimi K2.5 10.0 10.0 100.0% 0 92.47s 675 5,371 6,547
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Flash Lite 6.0 4.6 66.7% 2 2.15s 564 153 0
Kimi K2.5 5.3 7.3 44.4% 1 43.23s 659 8,426 12,692
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 3.51s 5,457 234 0
Kimi K2.5 10.0 10.0 100.0% 0 31.74s 5,933 242 812
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Flash Lite 3.0 10.0 0.0% 0 724ms 158 9 0
Kimi K2.5 3.0 10.0 0.0% 0 83.95s 211 12 7,644

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں