नेविगेशन
AI BENCHY
Advertise here

AI BENCHY तुलना

DeepSeek: DeepSeek V4 Pro vs MoonshotAI: Kimi K2.5

सारांश

DeepSeek V4 Pro vs Kimi K2.5 benchmark तुलना: DeepSeek V4 Pro average score में आगे है: 7.6 vs 7.5. DeepSeek V4 Pro की benchmark लागत कम है: $0.157 vs $0.348. DeepSeek V4 Pro तेज है: 77.20s vs 98.43s, pass rates 66.7% vs 68.3%.

अनुशंसित मॉडल: DeepSeek V4 Pro - It has the best score here (7.6), while costing about 2.2x less than Kimi K2.5.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-06-17

मेट्रिक DeepSeek V4 Pro DeepSeek V4 Pro high रिलीज़: 2026-04-24 Kimi K2.5 Kimi K2.5 medium रिलीज़: 2026-01-27
स्कोर 7.6 7.5
रैंक #41 #43
विश्वसनीयता 9.3 10.0
संगति 7.0 6.9
सही परीक्षण
प्रति प्रयास पास दर 66.7% 68.3%
अस्थिर टेस्ट 8 8
कुल रन 63 63
प्रति परिणाम लागत 1.742 3.704
कुल लागत $0.157 $0.348
इनपुट कीमत $0.435 / 1M $0.375 / 1M
आउटपुट कीमत $0.870 / 1M $2.025 / 1M
कुल इनपुट टोकन 38,726 34,312
आउटपुट टोकन 6,334 48,379
रीजनिंग टोकन 159,151 157,747
प्रतिक्रिया समय (औसत) 77.20s 98.43s
प्रतिक्रिया समय (अधिकतम) 416.76s 281.00s
प्रतिक्रिया समय (कुल) 1621.17s 1378.03s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#41 DeepSeek V4 Pro

high
Cost
$0.023
Time
257.6s
Tokens
14,870 tok

#43 MoonshotAI: Kimi K2.5

medium
Cost
$0.030
Time
58.6s
Tokens
8,683 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 5.7 5.9 58.3% 2 25.70s 536 149 3,214
Kimi K2.5 7.3 5.8 83.3% 2 51.38s 634 2,789 8,880
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 6.1 4.6 66.7% 2 243.00s 5,090 383 84,580
Kimi K2.5 6.1 4.6 66.7% 2 217.49s 6,935 5,705 74,693
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 10.0 10.0 100.0% 0 38.17s 14,060 454 5,836
Kimi K2.5 10.0 10.0 100.0% 0 71.37s 11,280 703 3,713
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 10.0 10.0 100.0% 0 25.03s 7,690 274 2,166
Kimi K2.5 10.0 10.0 100.0% 0 49.78s 7,020 563 7,940
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 3.6 7.2 22.2% 1 151.46s 569 4,404 50,391
Kimi K2.5 3.5 4.4 33.3% 2 137.29s 485 20,753 30,564
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 10.0 10.0 100.0% 0 8.83s 471 115 1,013
Kimi K2.5 6.5 3.4 66.7% 1 69.73s 480 3,815 4,262
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 7.8 6.6 83.3% 1 8.73s 627 66 2,726
Kimi K2.5 10.0 10.0 100.0% 0 92.47s 675 5,371 6,547
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 6.9 4.9 77.8% 2 56.85s 591 178 2,563
Kimi K2.5 5.3 7.3 44.4% 1 43.23s 659 8,426 12,692
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 9.8 10.0 100.0% 0 15.92s 8,909 295 701
Kimi K2.5 10.0 10.0 100.0% 0 31.74s 5,933 242 812
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 3.0 10.0 0.0% 0 34.01s 183 16 5,961
Kimi K2.5 3.0 10.0 0.0% 0 83.95s 211 12 7,644

त्वरित तुलना

तुलना जोड़ी बदलें