नेव्हिगेशन
AI BENCHY
Advertise here

Kimi K2.7 Code (medium) vs GPT-5.3 Chat

average score जवळपास समान आहे: 7.5 vs 7.5. GPT-5.3 Chat चा benchmark खर्च कमी आहे: $0.571 vs $0.692. GPT-5.3 Chat वेगवान आहे: 6.88s vs 84.25s, pass rates 65.2% vs 68.2%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-25

क्रमांक
#60
एकूण आउटपुट टोकन्स
262,507
प्रतिसाद वेळ (सरासरी)
84.25s
एकूण खर्च
$0.692
क्रमांक
#62
एकूण आउटपुट टोकन्स
30,854
प्रतिसाद वेळ (सरासरी)
6.88s
एकूण खर्च
$0.571
शिफारस केलेले मॉडेल GPT-5.3 Chat

It has the best score here (7.5), while responding about 12.2x faster than Kimi K2.7 Code (medium).

तपशीलवार तुलना

मेट्रिक Kimi K2.7 Code Kimi K2.7 Code medium प्रकाशन: 2026-06-12 GPT-5.3 Chat GPT-5.3 Chat none प्रकाशन: 2026-03-03
स्कोअर 7.5 7.5
क्रमांक #60 #62
विश्वसनीयता 10.0 10.0
सुसंगतता 8.3 8.2
बरोबर चाचण्या
प्रति प्रयत्न पास दर 65.2% 68.2%
अस्थिर चाचण्या 4 5
एकूण रन 66 66
प्रति निकाल खर्च 6.457 4.387
एकूण खर्च $0.692 $0.571
इनपुट किंमत $0.780 / 1M $1.750 / 1M
आउटपुट किंमत $3.500 / 1M $14.000 / 1M
एकूण इनपुट टोकन्स 72,073 78,990
आउटपुट टोकन्स 83,714 30,854
रिझनिंग टोकन्स 178,793 0
प्रतिसाद वेळ (सरासरी) 84.25s 6.88s
प्रतिसाद वेळ (कमाल) 365.80s 18.33s
प्रतिसाद वेळ (एकूण) 1769.22s 151.31s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#60 MoonshotAI: Kimi K2.7 Code

medium
खर्च
$0.025
वेळ
138.0s
टोकन्स
6,093 tok

#62 GPT-5.3 Chat

none
खर्च
$0.008
वेळ
8.1s
टोकन्स
634 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Kimi K2.7 Code 7.8 9.3 66.7% 0 146.73s 4,650 1,864 25,635
GPT-5.3 Chat 5.6 4.7 55.6% 2 10.52s 7,302 6,632 0

झटपट तुलना

तुलना जोडी बदला