نیویگیشن
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

MoonshotAI: Kimi K2.5 vs OpenAI: GPT-5.5

خلاصہ

Kimi K2.5 vs GPT-5.5 benchmark موازنہ: Kimi K2.5 average score میں آگے ہے: 6.8 vs 6.4. GPT-5.5 کی benchmark لاگت کم ہے: $0.231 vs $0.328. GPT-5.5 تیز ہے: 1.89s vs 98.43s، pass rates 68.3% vs 54.0%.

تجویز کردہ ماڈل: GPT-5.5 - Its score stays close to the best score here (6.4 vs 6.8), while responding about 52.1x faster than Kimi K2.5.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-06-04

میٹرک Kimi K2.5 Kimi K2.5 medium اجرا: 2026-01-27 GPT-5.5 GPT-5.5 none اجرا: 2026-04-24
اسکور 6.8 6.4
درجہ #76 #91
اعتماد پذیری 10.0 10.0
تسلسل 6.9 8.8
درست ٹیسٹس
فی کوشش کامیابی کی شرح 68.3% 54.0%
غیر مستحکم ٹیسٹ 8 3
کل رنز 63 63
فی نتیجہ لاگت 3.704 2.302
کل لاگت $0.328 $0.231
ان پٹ قیمت $0.400 / 1M $5.000 / 1M
آؤٹ پٹ قیمت $1.900 / 1M $30.000 / 1M
کل ان پٹ ٹوکنز 34,312 34,212
آؤٹ پٹ ٹوکنز 48,379 1,971
ریزننگ ٹوکنز 157,747 0
ردِعمل کا وقت (اوسط) 98.43s 1.89s
ردِعمل کا وقت (زیادہ سے زیادہ) 281.00s 5.56s
ردِعمل کا وقت (کل) 1378.03s 39.64s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#76 MoonshotAI: Kimi K2.5

medium
Cost
$0.030
Time
58.6s
Tokens
8,683 tok

#91 GPT-5.5

none
Cost
$0.090
Time
54.3s
Tokens
3,063 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.5 7.3 5.8 83.3% 2 51.38s 634 2,789 8,880
GPT-5.5 6.9 7.9 66.7% 1 1.31s 606 213 0
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.5 6.1 4.6 66.7% 2 217.49s 6,935 5,705 74,693
GPT-5.5 5.5 10.0 33.3% 0 1.35s 7,305 462 0
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.5 10.0 10.0 100.0% 0 71.37s 11,280 703 3,713
GPT-5.5 3.0 10.0 0.0% 0 5.56s 11,019 300 0
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.5 10.0 10.0 100.0% 0 49.78s 7,020 563 7,940
GPT-5.5 10.0 10.0 100.0% 0 1.18s 7,140 222 0
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.5 3.5 4.4 33.3% 2 137.29s 485 20,753 30,564
GPT-5.5 2.9 7.2 11.1% 1 1.31s 723 52 0
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.5 6.5 3.4 66.7% 1 69.73s 480 3,815 4,262
GPT-5.5 10.0 10.0 100.0% 0 3.41s 477 124 0
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.5 10.0 10.0 100.0% 0 92.47s 675 5,371 6,547
GPT-5.5 6.2 5.8 66.7% 1 1.15s 660 81 0
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.5 5.3 7.3 44.4% 1 43.23s 659 8,426 12,692
GPT-5.5 7.7 10.0 66.7% 0 1.29s 642 252 0
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.5 10.0 10.0 100.0% 0 31.74s 5,933 242 812
GPT-5.5 10.0 10.0 100.0% 0 3.90s 5,445 247 0
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.5 3.0 10.0 0.0% 0 83.95s 211 12 7,644
GPT-5.5 3.0 10.0 0.0% 0 5.01s 195 18 0

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں