नेविगेशन
AI BENCHY
Your ad here

AI BENCHY तुलना

MoonshotAI: Kimi K2.5 vs OpenAI: GPT-5.3 Chat

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-04-16

मेट्रिक Kimi K2.5 Kimi K2.5 medium रिलीज़: 2026-01-27 GPT-5.3 Chat GPT-5.3 Chat none रिलीज़: 2026-03-03
स्कोर 7.0 7.7
रैंक #45 #35
संगति 6.8 8.6
सही परीक्षण
प्रति प्रयास पास दर 72.2% 68.5%
अस्थिर टेस्ट 7 3
कुल रन 54 54
प्रति परिणाम लागत 2.444 3.082
कुल लागत $0.220 $0.340
???? ??? $0.383 / 1M $1.750 / 1M
????? ??? $1.720 / 1M $14.000 / 1M
आउटपुट टोकन 42,176 20,784
रीजनिंग टोकन 84,870 0
प्रतिक्रिया समय (औसत) 72.43s 5.88s
प्रतिक्रिया समय (अधिकतम) 150.77s 18.33s
प्रतिक्रिया समय (कुल) 796.70s 105.90s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Kimi K2.5 7.3 5.8 83.3% 2 51.38s 2,789 8,880
GPT-5.3 Chat 6.7 8.1 58.3% 1 3.86s 3,167 0
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Kimi K2.5 4.7 1.6 66.7% 1 150.77s 1,269 9,749
GPT-5.3 Chat 10.0 10.0 100.0% 0 9.32s 1,436 0
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Kimi K2.5 10.0 10.0 100.0% 0 71.37s 703 3,713
GPT-5.3 Chat 10.0 10.0 100.0% 0 11.96s 2,614 0
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Kimi K2.5 10.0 10.0 100.0% 0 49.78s 563 7,940
GPT-5.3 Chat 10.0 10.0 100.0% 0 2.21s 942 0
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Kimi K2.5 3.5 4.4 33.3% 2 137.29s 20,753 30,564
GPT-5.3 Chat 3.5 4.4 33.3% 2 13.01s 8,264 0
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Kimi K2.5 6.5 3.4 66.7% 1 69.73s 3,815 4,262
GPT-5.3 Chat 4.6 10.0 0.0% 0 1.99s 319 0
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Kimi K2.5 10.0 10.0 100.0% 0 92.47s 5,371 6,547
GPT-5.3 Chat 8.3 10.0 50.0% 0 3.29s 1,455 0
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Kimi K2.5 5.3 7.3 44.4% 1 45.40s 6,671 12,403
GPT-5.3 Chat 10.0 10.0 100.0% 0 2.93s 1,726 0
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Kimi K2.5 10.0 10.0 100.0% 0 31.74s 242 812
GPT-5.3 Chat 10.0 10.0 100.0% 0 8.36s 861 0

त्वरित तुलना

तुलना जोड़ी बदलें