नेविगेशन
AI BENCHY
Advertise here

AI BENCHY तुलना

MoonshotAI: Kimi K2.5 vs OpenAI: GPT-5.4 Mini

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-05-19

मेट्रिक Kimi K2.5 Kimi K2.5 medium रिलीज़: 2026-01-27 GPT-5.4 Mini GPT-5.4 Mini medium रिलीज़: 2026-03-17
स्कोर 6.8 7.2
रैंक #76 #67
विश्वसनीयता 10.0 10.0
संगति 7.0 7.9
सही परीक्षण
प्रति प्रयास पास दर 68.4% 68.4%
अस्थिर टेस्ट 7 5
कुल रन 57 57
प्रति परिणाम लागत 2.616 3.443
कुल लागत $0.236 $0.345
???? ??? $0.400 / 1M $0.750 / 1M
????? ??? $1.900 / 1M $4.500 / 1M
आउटपुट टोकन 42,188 2,163
रीजनिंग टोकन 92,514 69,741
प्रतिक्रिया समय (औसत) 73.39s 16.00s
प्रतिक्रिया समय (अधिकतम) 150.77s 102.91s
प्रतिक्रिया समय (कुल) 880.65s 303.99s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Kimi K2.5 7.3 5.8 83.3% 2 51.38s 2,789 8,880
GPT-5.4 Mini 8.6 7.9 91.7% 1 4.05s 296 2,876
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Kimi K2.5 4.7 1.6 66.7% 1 150.77s 1,269 9,749
GPT-5.4 Mini 10.0 10.0 100.0% 0 7.76s 423 1,548
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Kimi K2.5 10.0 10.0 100.0% 0 71.37s 703 3,713
GPT-5.4 Mini 10.0 10.0 100.0% 0 17.81s 317 4,317
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Kimi K2.5 10.0 10.0 100.0% 0 49.78s 563 7,940
GPT-5.4 Mini 10.0 10.0 100.0% 0 2.43s 234 650
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Kimi K2.5 3.5 4.4 33.3% 2 137.29s 20,753 30,564
GPT-5.4 Mini 4.1 4.4 44.5% 2 65.31s 60 43,286
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Kimi K2.5 6.5 3.4 66.7% 1 69.73s 3,815 4,262
GPT-5.4 Mini 4.5 10.0 0.0% 0 3.72s 150 510
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Kimi K2.5 10.0 10.0 100.0% 0 92.47s 5,371 6,547
GPT-5.4 Mini 7.4 6.7 66.7% 1 2.50s 129 1,337
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Kimi K2.5 5.3 7.3 44.4% 1 45.40s 6,671 12,403
GPT-5.4 Mini 7.8 10.0 66.7% 0 4.33s 271 2,449
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Kimi K2.5 10.0 10.0 100.0% 0 31.74s 242 812
GPT-5.4 Mini 4.7 1.6 66.7% 1 9.62s 251 2,594
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Kimi K2.5 3.0 10.0 0.0% 0 83.95s 12 7,644
GPT-5.4 Mini 3.0 10.0 0.0% 0 30.10s 32 10,174

त्वरित तुलना

तुलना जोड़ी बदलें