नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY तुलना

MiniMax: MiniMax M2.7 vs MoonshotAI: Kimi K2.5

सारांश

MiniMax M2.7 vs Kimi K2.5 benchmark तुलना: Kimi K2.5 average score में आगे है: 5.5 vs 5.2. Kimi K2.5 की benchmark लागत कम है: $0.027 vs $0.104. Kimi K2.5 तेज है: 13.18s vs 38.18s, pass rates 46.0% vs 34.9%.

अनुशंसित मॉडल: Kimi K2.5 - It has the best score here (5.5), while costing about 3.9x less than MiniMax M2.7.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-06-18

मेट्रिक MiniMax M2.7 MiniMax M2.7 medium रिलीज़: 2026-03-18 Kimi K2.5 Kimi K2.5 none रिलीज़: 2026-01-27
स्कोर 5.2 5.5
रैंक #127 #118
विश्वसनीयता 10.0 10.0
संगति 6.8 8.9
सही परीक्षण
प्रति प्रयास पास दर 46.0% 34.9%
अस्थिर टेस्ट 8 3
कुल रन 63 63
प्रति परिणाम लागत 2.494 0.442
कुल लागत $0.104 $0.027
इनपुट कीमत $0.250 / 1M $0.375 / 1M
आउटपुट कीमत $1.000 / 1M $2.025 / 1M
कुल इनपुट टोकन 34,371 36,034
आउटपुट टोकन 8,981 6,657
रीजनिंग टोकन 89,812 0
प्रतिक्रिया समय (औसत) 38.18s 13.18s
प्रतिक्रिया समय (अधिकतम) 196.21s 42.13s
प्रतिक्रिया समय (कुल) 763.60s 184.47s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#127 MiniMax M2.7

medium
Cost
$0.022
Time
22.8s
Tokens
9,250 tok

#118 MoonshotAI: Kimi K2.5

none
Cost
$0.015
Time
89.1s
Tokens
5,421 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
MiniMax M2.7 7.9 6.3 83.3% 2 40.32s 654 3,010 17,716
Kimi K2.5 3.6 8.4 8.3% 1 6.24s 652 373 0
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
MiniMax M2.7 5.7 9.1 33.3% 0 101.89s 2,961 1,231 38,841
Kimi K2.5 5.5 10.0 33.3% 0 24.56s 7,311 4,708 0
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
MiniMax M2.7 4.7 1.6 66.7% 1 41.03s 14,233 369 4,480
Kimi K2.5 2.8 2.1 33.3% 1 19.16s 12,264 748 0
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
MiniMax M2.7 6.3 5.8 66.7% 1 21.95s 7,152 187 5,882
Kimi K2.5 7.3 5.8 83.3% 1 42.13s 7,180 187 0
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
MiniMax M2.7 3.0 10.0 0.0% 0 19.00s 245 8 2,796
Kimi K2.5 5.3 10.0 33.3% 0 4.38s 753 29 0
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
MiniMax M2.7 3.9 2.5 33.3% 1 38.70s 486 92 5,204
Kimi K2.5 10.0 10.0 100.0% 0 4.00s 483 76 0
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
MiniMax M2.7 3.8 5.8 33.3% 1 12.80s 687 350 2,600
Kimi K2.5 6.5 10.0 50.0% 0 2.67s 677 60 0
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
MiniMax M2.7 5.9 7.2 55.6% 1 24.87s 675 362 7,840
Kimi K2.5 3.0 10.0 0.0% 0 4.04s 667 236 0
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
MiniMax M2.7 4.7 1.6 66.7% 1 12.05s 7,067 304 1,001
Kimi K2.5 10.0 10.0 100.0% 0 13.99s 5,835 220 0
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
MiniMax M2.7 3.0 10.0 0.0% 0 22.77s 211 3,068 3,452
Kimi K2.5 3.0 10.0 0.0% 0 3.90s 212 20 0

त्वरित तुलना

तुलना जोड़ी बदलें