نیویگیشن
AI BENCHY
Advertise here

AI BENCHY Compare

Anthropic: Claude Opus 4.8 vs MoonshotAI: Kimi K2.7 Code

خلاصہ

Claude Opus 4.8 vs Kimi K2.7 Code benchmark موازنہ: Claude Opus 4.8 average score میں آگے ہے: 7.2 vs 7.0. Claude Opus 4.8 کی benchmark لاگت کم ہے: $0.539 vs $0.669. Claude Opus 4.8 تیز ہے: 3.47s vs 83.60s، pass rates 61.9% vs 66.7%.

تجویز کردہ ماڈل: Claude Opus 4.8 - It has the best score here (7.2), while responding about 24.1x faster than Kimi K2.7 Code.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-06-12

میٹرک Claude Opus 4.8 Claude Opus 4.8 none اجرا: 2026-05-28 Kimi K2.7 Code Kimi K2.7 Code medium اجرا: 2026-06-12
اسکور 7.2 7.0
درجہ #59 #65
اعتماد پذیری 10.0 9.2
تسلسل 9.2 7.7
درست ٹیسٹس
فی کوشش کامیابی کی شرح 61.9% 66.7%
غیر مستحکم ٹیسٹ 2 6
کل رنز 63 63
فی نتیجہ لاگت 4.485 6.074
کل لاگت $0.539 $0.669
ان پٹ قیمت $5.000 / 1M $0.950 / 1M
آؤٹ پٹ قیمت $25.000 / 1M $4.000 / 1M
کل ان پٹ ٹوکنز 67,104 25,991
آؤٹ پٹ ٹوکنز 8,107 80,516
ریزننگ ٹوکنز 0 161,391
ردِعمل کا وقت (اوسط) 3.47s 83.60s
ردِعمل کا وقت (زیادہ سے زیادہ) 17.73s 365.80s
ردِعمل کا وقت (کل) 72.90s 1671.99s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#59 Claude Opus 4.8

none
Cost
$0.053
Time
22.0s
Tokens
2,253 tok

#65 MoonshotAI: Kimi K2.7 Code

medium
Cost
$0.025
Time
138.0s
Tokens
6,093 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 6.5 10.0 50.0% 0 3.40s 834 1,472 0
Kimi K2.7 Code 7.3 5.8 83.3% 2 11.56s 618 3,048 5,041
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 5.5 10.0 33.3% 0 3.29s 10,590 1,332 0
Kimi K2.7 Code 7.6 7.2 77.8% 1 146.73s 4,650 1,864 25,635
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 9.5 10.0 100.0% 0 17.73s 29,658 3,259 0
Kimi K2.7 Code 4.7 1.6 66.7% 1 34.83s 11,271 444 3,906
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 7.3 5.8 83.3% 1 1.77s 10,503 308 0
Kimi K2.7 Code 10.0 10.0 100.0% 0 12.27s 7,014 248 2,569
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 5.3 7.2 44.4% 1 1.66s 975 61 0
Kimi K2.7 Code 5.3 7.2 44.4% 1 213.29s 431 55,572 63,639
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 10.0 10.0 100.0% 0 3.48s 708 230 0
Kimi K2.7 Code 10.0 10.0 100.0% 0 10.78s 477 1,024 1,071
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 9.9 10.0 100.0% 0 1.37s 909 95 0
Kimi K2.7 Code 9.9 10.0 100.0% 0 5.39s 669 725 1,232
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 7.7 10.0 66.7% 0 2.74s 894 783 0
Kimi K2.7 Code 5.9 7.7 44.4% 1 41.00s 651 15,438 17,368
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 10.0 10.0 100.0% 0 5.35s 11,775 355 0
Kimi K2.7 Code 3.0 10.0 0.0% 0 0ms 0 0 0
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 4.8 3.0 10.0 0.0% 0 3.41s 258 212 0
Kimi K2.7 Code 3.0 10.0 0.0% 0 341.76s 210 2,153 40,930

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں