نیویگیشن
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

MoonshotAI: Kimi K2.7 Code vs OpenAI: GPT-5.3 Chat

خلاصہ

Kimi K2.7 Code vs GPT-5.3 Chat benchmark موازنہ: GPT-5.3 Chat average score میں آگے ہے: 7.5 vs 7.0. GPT-5.3 Chat کی benchmark لاگت کم ہے: $0.433 vs $0.669. GPT-5.3 Chat تیز ہے: 6.34s vs 83.60s، pass rates 66.7% vs 66.7%.

تجویز کردہ ماڈل: GPT-5.3 Chat - It has the best score here (7.5), while costing about 1.5x less than Kimi K2.7 Code.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-06-12

میٹرک Kimi K2.7 Code Kimi K2.7 Code medium اجرا: 2026-06-12 GPT-5.3 Chat GPT-5.3 Chat none اجرا: 2026-03-03
اسکور 7.0 7.5
درجہ #65 #47
اعتماد پذیری 9.2 10.0
تسلسل 7.7 8.1
درست ٹیسٹس
فی کوشش کامیابی کی شرح 66.7% 66.7%
غیر مستحکم ٹیسٹ 6 5
کل رنز 63 63
فی نتیجہ لاگت 6.074 3.605
کل لاگت $0.669 $0.433
ان پٹ قیمت $0.950 / 1M $1.750 / 1M
آؤٹ پٹ قیمت $4.000 / 1M $14.000 / 1M
کل ان پٹ ٹوکنز 25,991 34,209
آؤٹ پٹ ٹوکنز 80,516 26,617
ریزننگ ٹوکنز 161,391 0
ردِعمل کا وقت (اوسط) 83.60s 6.34s
ردِعمل کا وقت (زیادہ سے زیادہ) 365.80s 18.33s
ردِعمل کا وقت (کل) 1671.99s 133.13s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#65 MoonshotAI: Kimi K2.7 Code

medium
Cost
$0.025
Time
138.0s
Tokens
6,093 tok

#47 GPT-5.3 Chat

none
Cost
$0.008
Time
8.1s
Tokens
634 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.7 Code 7.3 5.8 83.3% 2 11.56s 618 3,048 5,041
GPT-5.3 Chat 6.7 8.1 58.3% 1 3.86s 606 3,167 0
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.7 Code 7.6 7.2 77.8% 1 146.73s 4,650 1,864 25,635
GPT-5.3 Chat 5.6 4.7 55.6% 2 10.52s 7,302 6,632 0
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.7 Code 4.7 1.6 66.7% 1 34.83s 11,271 444 3,906
GPT-5.3 Chat 10.0 10.0 100.0% 0 11.96s 11,019 2,614 0
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.7 Code 10.0 10.0 100.0% 0 12.27s 7,014 248 2,569
GPT-5.3 Chat 10.0 10.0 100.0% 0 2.21s 7,140 942 0
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.7 Code 5.3 7.2 44.4% 1 213.29s 431 55,572 63,639
GPT-5.3 Chat 3.5 4.4 33.3% 2 13.01s 723 8,264 0
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.7 Code 10.0 10.0 100.0% 0 10.78s 477 1,024 1,071
GPT-5.3 Chat 4.6 10.0 0.0% 0 1.99s 477 319 0
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.7 Code 9.9 10.0 100.0% 0 5.39s 669 725 1,232
GPT-5.3 Chat 9.8 10.0 100.0% 0 3.51s 660 1,491 0
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.7 Code 5.9 7.7 44.4% 1 41.00s 651 15,438 17,368
GPT-5.3 Chat 10.0 10.0 100.0% 0 2.99s 642 1,758 0
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.7 Code 3.0 10.0 0.0% 0 0ms 0 0 0
GPT-5.3 Chat 10.0 10.0 100.0% 0 8.36s 5,445 861 0
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.7 Code 3.0 10.0 0.0% 0 341.76s 210 2,153 40,930
GPT-5.3 Chat 3.0 10.0 0.0% 0 4.38s 195 569 0

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں