नेव्हिगेशन
AI BENCHY
Advertise here

AI BENCHY Compare

MoonshotAI: Kimi K2.5 vs OpenAI: GPT-5.3 Chat

सारांश

Kimi K2.5 vs GPT-5.3 Chat benchmark तुलना: GPT-5.3 Chat average score मध्ये पुढे आहे: 7.2 vs 6.8. Kimi K2.5 चा benchmark खर्च कमी आहे: $0.328 vs $0.433. GPT-5.3 Chat वेगवान आहे: 6.34s vs 98.43s, pass rates 68.3% vs 66.7%.

शिफारस केलेले मॉडेल: GPT-5.3 Chat - It has the best score here (7.2), while responding about 15.5x faster than Kimi K2.5.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-06-04

मेट्रिक Kimi K2.5 Kimi K2.5 medium प्रकाशन: 2026-01-27 GPT-5.3 Chat GPT-5.3 Chat none प्रकाशन: 2026-03-03
स्कोअर 6.8 7.2
क्रमांक #76 #63
विश्वसनीयता 10.0 10.0
सुसंगतता 6.9 8.1
बरोबर चाचण्या
प्रति प्रयत्न पास दर 68.3% 66.7%
अस्थिर चाचण्या 8 5
एकूण रन 63 63
प्रति निकाल खर्च 3.704 3.605
एकूण खर्च $0.328 $0.433
इनपुट किंमत $0.400 / 1M $1.750 / 1M
आउटपुट किंमत $1.900 / 1M $14.000 / 1M
एकूण इनपुट टोकन्स 34,312 34,209
आउटपुट टोकन्स 48,379 26,617
रिझनिंग टोकन्स 157,747 0
प्रतिसाद वेळ (सरासरी) 98.43s 6.34s
प्रतिसाद वेळ (कमाल) 281.00s 18.33s
प्रतिसाद वेळ (एकूण) 1378.03s 133.13s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#76 MoonshotAI: Kimi K2.5

medium
Cost
$0.030
Time
58.6s
Tokens
8,683 tok

#63 GPT-5.3 Chat

none
Cost
$0.008
Time
8.1s
Tokens
634 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Kimi K2.5 7.3 5.8 83.3% 2 51.38s 634 2,789 8,880
GPT-5.3 Chat 6.7 8.1 58.3% 1 3.86s 606 3,167 0
कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Kimi K2.5 6.1 4.6 66.7% 2 217.49s 6,935 5,705 74,693
GPT-5.3 Chat 5.6 4.7 55.6% 2 10.52s 7,302 6,632 0
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Kimi K2.5 10.0 10.0 100.0% 0 71.37s 11,280 703 3,713
GPT-5.3 Chat 10.0 10.0 100.0% 0 11.96s 11,019 2,614 0
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Kimi K2.5 10.0 10.0 100.0% 0 49.78s 7,020 563 7,940
GPT-5.3 Chat 10.0 10.0 100.0% 0 2.21s 7,140 942 0
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Kimi K2.5 3.5 4.4 33.3% 2 137.29s 485 20,753 30,564
GPT-5.3 Chat 3.5 4.4 33.3% 2 13.01s 723 8,264 0
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Kimi K2.5 6.5 3.4 66.7% 1 69.73s 480 3,815 4,262
GPT-5.3 Chat 4.6 10.0 0.0% 0 1.99s 477 319 0
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Kimi K2.5 10.0 10.0 100.0% 0 92.47s 675 5,371 6,547
GPT-5.3 Chat 9.8 10.0 100.0% 0 3.51s 660 1,491 0
कोडी सोडवणे स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Kimi K2.5 5.3 7.3 44.4% 1 43.23s 659 8,426 12,692
GPT-5.3 Chat 10.0 10.0 100.0% 0 2.99s 642 1,758 0
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Kimi K2.5 10.0 10.0 100.0% 0 31.74s 5,933 242 812
GPT-5.3 Chat 10.0 10.0 100.0% 0 8.36s 5,445 861 0
सामान्य ज्ञान स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Kimi K2.5 3.0 10.0 0.0% 0 83.95s 211 12 7,644
GPT-5.3 Chat 3.0 10.0 0.0% 0 4.38s 195 569 0

झटपट तुलना

तुलना जोडी बदला