नेविगेशन
AI BENCHY
Advertise here

AI BENCHY तुलना

MoonshotAI: Kimi K2.6 vs OpenAI: gpt-oss-120b

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-06-04

मेट्रिक Kimi K2.6 Kimi K2.6 none रिलीज़: 2026-04-20 निःशुल्क उपलब्ध gpt-oss-120b gpt-oss-120b medium रिलीज़: 2025-08-05 निःशुल्क उपलब्ध
स्कोर 5.5 6.1
रैंक #124 #99
विश्वसनीयता 10.0 10.0
संगति 9.2 8.0
सही परीक्षण
प्रति प्रयास पास दर 36.5% 52.4%
अस्थिर टेस्ट 2 5
कुल रन 63 63
प्रति परिणाम लागत 1.267 0.141
कुल लागत $0.079 $0.013
इनपुट कीमत $0.684 / 1M $0.039 / 1M
आउटपुट कीमत $3.420 / 1M $0.180 / 1M
कुल इनपुट टोकन 32,916 39,084
आउटपुट टोकन 16,410 20,013
रीजनिंग टोकन 0 50,233
प्रतिक्रिया समय (औसत) 13.27s 22.28s
प्रतिक्रिया समय (अधिकतम) 238.89s 68.16s
प्रतिक्रिया समय (कुल) 278.57s 311.96s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Kimi K2.6 4.6 10.0 25.0% 0 1.39s 618 471 0
gpt-oss-120b 6.7 9.9 50.0% 0 10.21s 1,314 3,518 2,177
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Kimi K2.6 5.5 9.8 33.3% 0 82.57s 5,986 14,754 0
gpt-oss-120b 5.9 7.0 55.6% 1 38.37s 7,782 3,365 11,973
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Kimi K2.6 3.0 10.0 0.0% 0 3.38s 11,269 290 0
gpt-oss-120b 10.0 10.0 100.0% 0 31.18s 11,535 694 5,072
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Kimi K2.6 10.0 10.0 100.0% 0 1.32s 7,014 201 0
gpt-oss-120b 6.4 5.9 66.7% 1 1.98s 7,476 241 1,114
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Kimi K2.6 5.3 7.2 44.4% 1 1.48s 732 42 0
gpt-oss-120b 2.9 4.4 22.2% 2 50.92s 1,266 6,784 20,606
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Kimi K2.6 5.4 3.5 33.3% 1 1.55s 477 138 0
gpt-oss-120b 4.3 10.0 0.0% 0 7.90s 659 107 387
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Kimi K2.6 6.5 10.0 50.0% 0 1.64s 669 72 0
gpt-oss-120b 9.9 10.0 100.0% 0 7.63s 1,036 126 1,799
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Kimi K2.6 3.1 9.9 0.0% 0 1.40s 651 185 0
gpt-oss-120b 5.3 7.2 44.4% 1 21.71s 1,190 1,790 2,264
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Kimi K2.6 10.0 10.0 100.0% 0 4.46s 5,286 240 0
gpt-oss-120b 9.8 10.0 100.0% 0 6.91s 6,514 287 1,083
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Kimi K2.6 3.0 10.0 0.0% 0 1.36s 214 17 0
gpt-oss-120b 3.0 10.0 0.0% 0 26.51s 312 3,101 3,758

त्वरित तुलना

तुलना जोड़ी बदलें