نیویگیشن
AI BENCHY
Advertise here

AI BENCHY Compare

MoonshotAI: Kimi K2.5 vs OpenAI: GPT-5.5

خلاصہ

Kimi K2.5 vs GPT-5.5 benchmark موازنہ: GPT-5.5 average score میں آگے ہے: 9.3 vs 7.5. Kimi K2.5 کی benchmark لاگت کم ہے: $0.348 vs $0.907. GPT-5.5 تیز ہے: 9.76s vs 98.43s، pass rates 68.3% vs 85.7%.

تجویز کردہ ماڈل: GPT-5.5 - It has the best score here (9.3), while responding about 10.1x faster than Kimi K2.5.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-07-02

میٹرک Kimi K2.5 Kimi K2.5 medium اجرا: 2026-01-27 GPT-5.5 GPT-5.5 low اجرا: 2026-04-24
اسکور 7.5 9.3
درجہ #45 #4
اعتماد پذیری 10.0 10.0
تسلسل 6.9 10.0
درست ٹیسٹس
فی کوشش کامیابی کی شرح 68.3% 85.7%
غیر مستحکم ٹیسٹ 8 0
کل رنز 63 63
فی نتیجہ لاگت 3.704 5.035
کل لاگت $0.348 $0.907
ان پٹ قیمت $0.375 / 1M $5.000 / 1M
آؤٹ پٹ قیمت $2.025 / 1M $30.000 / 1M
کل ان پٹ ٹوکنز 34,312 34,209
آؤٹ پٹ ٹوکنز 48,379 2,046
ریزننگ ٹوکنز 157,747 22,460
ردِعمل کا وقت (اوسط) 98.43s 9.76s
ردِعمل کا وقت (زیادہ سے زیادہ) 281.00s 56.19s
ردِعمل کا وقت (کل) 1378.03s 204.92s

جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#45 MoonshotAI: Kimi K2.5

medium
لاگت
$0.030
وقت
58.6s
ٹوکنز
8,683 tok

#4 GPT-5.5

low
لاگت
$0.068
وقت
37.0s
ٹوکنز
2,339 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.5 7.3 5.8 83.3% 2 51.38s 634 2,789 8,880
GPT-5.5 10.0 10.0 100.0% 0 4.41s 606 238 1,020
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.5 6.1 4.6 66.7% 2 217.49s 6,935 5,705 74,693
GPT-5.5 10.0 10.0 100.0% 0 15.04s 7,302 423 6,402
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.5 10.0 10.0 100.0% 0 71.37s 11,280 703 3,713
GPT-5.5 10.0 10.0 100.0% 0 9.56s 11,019 303 717
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.5 10.0 10.0 100.0% 0 49.78s 7,020 563 7,940
GPT-5.5 10.0 10.0 100.0% 0 3.28s 7,140 228 157
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.5 3.5 4.4 33.3% 2 137.29s 485 20,753 30,564
GPT-5.5 5.3 10.0 33.3% 0 28.05s 723 69 11,609
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.5 6.5 3.4 66.7% 1 69.73s 480 3,815 4,262
GPT-5.5 10.0 10.0 100.0% 0 5.17s 477 133 245
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.5 10.0 10.0 100.0% 0 92.47s 675 5,371 6,547
GPT-5.5 9.9 10.0 100.0% 0 3.74s 660 93 415
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.5 5.3 7.3 44.4% 1 43.23s 659 8,426 12,692
GPT-5.5 10.0 10.0 100.0% 0 4.74s 642 279 954
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.5 10.0 10.0 100.0% 0 31.74s 5,933 242 812
GPT-5.5 10.0 10.0 100.0% 0 4.96s 5,445 250 101
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.5 3.0 10.0 0.0% 0 83.95s 211 12 7,644
GPT-5.5 3.0 10.0 0.0% 0 10.06s 195 30 840

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں