نیویگیشن
AI BENCHY
Advertise here

AI BENCHY Compare

MoonshotAI: Kimi K2.5 vs OpenAI: GPT-5.3 Chat

خلاصہ

Kimi K2.5 vs GPT-5.3 Chat benchmark موازنہ: GPT-5.3 Chat average score میں آگے ہے: 7.2 vs 6.8. Kimi K2.5 کی benchmark لاگت کم ہے: $0.328 vs $0.433. GPT-5.3 Chat تیز ہے: 6.34s vs 98.43s، pass rates 68.3% vs 66.7%.

تجویز کردہ ماڈل: GPT-5.3 Chat - It has the best score here (7.2), while responding about 15.5x faster than Kimi K2.5.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-06-04

میٹرک Kimi K2.5 Kimi K2.5 medium اجرا: 2026-01-27 GPT-5.3 Chat GPT-5.3 Chat none اجرا: 2026-03-03
اسکور 6.8 7.2
درجہ #76 #63
اعتماد پذیری 10.0 10.0
تسلسل 6.9 8.1
درست ٹیسٹس
فی کوشش کامیابی کی شرح 68.3% 66.7%
غیر مستحکم ٹیسٹ 8 5
کل رنز 63 63
فی نتیجہ لاگت 3.704 3.605
کل لاگت $0.328 $0.433
ان پٹ قیمت $0.400 / 1M $1.750 / 1M
آؤٹ پٹ قیمت $1.900 / 1M $14.000 / 1M
کل ان پٹ ٹوکنز 34,312 34,209
آؤٹ پٹ ٹوکنز 48,379 26,617
ریزننگ ٹوکنز 157,747 0
ردِعمل کا وقت (اوسط) 98.43s 6.34s
ردِعمل کا وقت (زیادہ سے زیادہ) 281.00s 18.33s
ردِعمل کا وقت (کل) 1378.03s 133.13s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#76 MoonshotAI: Kimi K2.5

medium
Cost
$0.030
Time
58.6s
Tokens
8,683 tok

#63 GPT-5.3 Chat

none
Cost
$0.008
Time
8.1s
Tokens
634 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.5 7.3 5.8 83.3% 2 51.38s 634 2,789 8,880
GPT-5.3 Chat 6.7 8.1 58.3% 1 3.86s 606 3,167 0
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.5 6.1 4.6 66.7% 2 217.49s 6,935 5,705 74,693
GPT-5.3 Chat 5.6 4.7 55.6% 2 10.52s 7,302 6,632 0
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.5 10.0 10.0 100.0% 0 71.37s 11,280 703 3,713
GPT-5.3 Chat 10.0 10.0 100.0% 0 11.96s 11,019 2,614 0
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.5 10.0 10.0 100.0% 0 49.78s 7,020 563 7,940
GPT-5.3 Chat 10.0 10.0 100.0% 0 2.21s 7,140 942 0
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.5 3.5 4.4 33.3% 2 137.29s 485 20,753 30,564
GPT-5.3 Chat 3.5 4.4 33.3% 2 13.01s 723 8,264 0
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.5 6.5 3.4 66.7% 1 69.73s 480 3,815 4,262
GPT-5.3 Chat 4.6 10.0 0.0% 0 1.99s 477 319 0
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.5 10.0 10.0 100.0% 0 92.47s 675 5,371 6,547
GPT-5.3 Chat 9.8 10.0 100.0% 0 3.51s 660 1,491 0
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.5 5.3 7.3 44.4% 1 43.23s 659 8,426 12,692
GPT-5.3 Chat 10.0 10.0 100.0% 0 2.99s 642 1,758 0
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.5 10.0 10.0 100.0% 0 31.74s 5,933 242 812
GPT-5.3 Chat 10.0 10.0 100.0% 0 8.36s 5,445 861 0
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.5 3.0 10.0 0.0% 0 83.95s 211 12 7,644
GPT-5.3 Chat 3.0 10.0 0.0% 0 4.38s 195 569 0

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں