نیویگیشن
AI BENCHY
Advertise here

Kimi K2.6 (medium) vs Qwen3.7 Plus

Qwen3.7 Plus average score میں آگے ہے: 7.3 vs 7.2. Qwen3.7 Plus کی benchmark لاگت کم ہے: $0.106 vs $1.247. Qwen3.7 Plus تیز ہے: 12.11s vs 115.89s، pass rates 63.6% vs 54.6%.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-08-29

درجہ
#107
کل آؤٹ پٹ ٹوکنز
347,519
ردِعمل کا وقت (اوسط)
115.89s
کل لاگت
$1.247
درجہ
#104
کل آؤٹ پٹ ٹوکنز
58,097
ردِعمل کا وقت (اوسط)
12.11s
کل لاگت
$0.106
تجویز کردہ ماڈل Qwen3.7 Plus

It has the best score here (7.3), while costing about 11.8x less than Kimi K2.6 (medium).

تفصیلی موازنہ

میٹرک Kimi K2.6 Kimi K2.6 medium اجرا: 2026-04-20 Qwen3.7 Plus Qwen3.7 Plus none اجرا: 2026-06-03
اسکور 7.2 7.3
درجہ #107 #104
اعتماد پذیری 10.0 10.0
تسلسل 8.3 10.0
کوششیں 66/66 66/66
درست ٹیسٹس
فی کوشش کامیابی کی شرح 63.6% 54.6%
غیر مستحکم ٹیسٹ 4 0
کل رنز 66 66
فی نتیجہ لاگت 10.029 0.930
کل لاگت $1.247 $0.106
ان پٹ قیمت $0.950 / 1M $0.320 / 1M
آؤٹ پٹ قیمت $4.000 / 1M $1.280 / 1M
کل ان پٹ ٹوکنز 68,913 98,833
آؤٹ پٹ ٹوکنز 64,654 58,097
ریزننگ ٹوکنز 282,865 0
ردِعمل کا وقت (اوسط) 115.89s 12.11s
ردِعمل کا وقت (زیادہ سے زیادہ) 876.20s 206.03s
ردِعمل کا وقت (کل) 2433.66s 266.40s
پیرامیٹرز 1T کل (32B فعال) ~397B کل (~17B فعال)
دستیابی وزن دستیاب بند ماخذ

ماڈل جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#107 MoonshotAI: Kimi K2.6

medium
لاگت
$0.013
وقت
103.4s
ٹوکنز
3,620 tok

#104 Qwen3.7 Plus

none
لاگت
$0.019
وقت
213.5s
ٹوکنز
11,960 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.6 5.7 8.6 33.3% 0 214.42s 2,925 9,970 77,189
Qwen3.7 Plus 5.5 10.0 33.3% 0 2.15s 7,911 639 0

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں