نیویگیشن
AI BENCHY
Advertise here

AI BENCHY Compare

MoonshotAI: Kimi K2.5 vs OpenAI: GPT-5.4 Nano

خلاصہ

Kimi K2.5 vs GPT-5.4 Nano benchmark موازنہ: average score تقریباً برابر ہے: 7.5 vs 7.5. GPT-5.4 Nano کی benchmark لاگت کم ہے: $0.107 vs $0.328. GPT-5.4 Nano تیز ہے: 11.95s vs 98.43s، pass rates 68.3% vs 63.5%.

تجویز کردہ ماڈل: GPT-5.4 Nano - It has the best score here (7.5), while costing about 3.1x less than Kimi K2.5.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-06-12

میٹرک Kimi K2.5 Kimi K2.5 medium اجرا: 2026-01-27 GPT-5.4 Nano GPT-5.4 Nano medium اجرا: 2026-03-17
اسکور 7.5 7.5
درجہ #45 #48
اعتماد پذیری 10.0 10.0
تسلسل 6.9 8.4
درست ٹیسٹس
فی کوشش کامیابی کی شرح 68.3% 63.5%
غیر مستحکم ٹیسٹ 8 4
کل رنز 63 63
فی نتیجہ لاگت 3.704 0.969
کل لاگت $0.328 $0.107
ان پٹ قیمت $0.400 / 1M $0.200 / 1M
آؤٹ پٹ قیمت $1.900 / 1M $1.250 / 1M
کل ان پٹ ٹوکنز 34,312 35,434
آؤٹ پٹ ٹوکنز 48,379 3,014
ریزننگ ٹوکنز 157,747 76,520
ردِعمل کا وقت (اوسط) 98.43s 11.95s
ردِعمل کا وقت (زیادہ سے زیادہ) 281.00s 94.06s
ردِعمل کا وقت (کل) 1378.03s 250.98s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#45 MoonshotAI: Kimi K2.5

medium
Cost
$0.030
Time
58.6s
Tokens
8,683 tok

#48 GPT-5.4 Nano

medium
Cost
$0.007
Time
24.6s
Tokens
4,943 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.5 7.3 5.8 83.3% 2 51.38s 634 2,789 8,880
GPT-5.4 Nano 8.3 10.0 75.0% 0 4.52s 606 683 2,254
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.5 6.1 4.6 66.7% 2 217.49s 6,935 5,705 74,693
GPT-5.4 Nano 6.1 4.7 66.7% 2 19.12s 7,305 516 20,778
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.5 10.0 10.0 100.0% 0 71.37s 11,280 703 3,713
GPT-5.4 Nano 9.8 10.0 100.0% 0 24.13s 12,345 349 5,719
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.5 10.0 10.0 100.0% 0 49.78s 7,020 563 7,940
GPT-5.4 Nano 10.0 10.0 100.0% 0 2.54s 7,140 234 516
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.5 3.5 4.4 33.3% 2 137.29s 485 20,753 30,564
GPT-5.4 Nano 5.9 7.2 55.6% 1 38.18s 619 60 43,325
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.5 6.5 3.4 66.7% 1 69.73s 480 3,815 4,262
GPT-5.4 Nano 4.5 10.0 0.0% 0 4.15s 477 179 443
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.5 10.0 10.0 100.0% 0 92.47s 675 5,371 6,547
GPT-5.4 Nano 9.8 10.0 100.0% 0 1.88s 660 95 521
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.5 5.3 7.3 44.4% 1 43.23s 659 8,426 12,692
GPT-5.4 Nano 4.1 7.2 22.2% 1 3.79s 642 594 1,408
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.5 10.0 10.0 100.0% 0 31.74s 5,933 242 812
GPT-5.4 Nano 10.0 10.0 100.0% 0 7.71s 5,445 234 382
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.5 3.0 10.0 0.0% 0 83.95s 211 12 7,644
GPT-5.4 Nano 3.0 10.0 0.0% 0 4.81s 195 70 1,174

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں