नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY तुलना

Cobuddy vs MoonshotAI: Kimi K2.5

सारांश

Cobuddy vs Kimi K2.5 benchmark तुलना: Kimi K2.5 average score में आगे है: 5.5 vs 4.9. Cobuddy की benchmark लागत कम है: $0.000 vs $0.027. Kimi K2.5 तेज है: 13.18s vs 39.90s, pass rates 47.6% vs 34.9%.

अनुशंसित मॉडल: Kimi K2.5 - It has the best score here (5.5), while responding about 3.0x faster than Cobuddy.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-02

मेट्रिक Cobuddy Cobuddy medium रिलीज़: 2026-05-06 Kimi K2.5 Kimi K2.5 none रिलीज़: 2026-01-27
स्कोर 4.9 5.5
रैंक #145 #122
विश्वसनीयता 10.0 10.0
संगति 7.5 8.9
सही परीक्षण
प्रति प्रयास पास दर 47.6% 34.9%
अस्थिर टेस्ट 6 3
कुल रन 63 63
प्रति परिणाम लागत 0.000 0.442
कुल लागत $0.000 $0.027
इनपुट कीमत $0.000 / 1M $0.375 / 1M
आउटपुट कीमत $0.000 / 1M $2.025 / 1M
कुल इनपुट टोकन 37,449 36,034
आउटपुट टोकन 1,677 6,657
रीजनिंग टोकन 116,703 0
प्रतिक्रिया समय (औसत) 39.90s 13.18s
प्रतिक्रिया समय (अधिकतम) 309.02s 42.13s
प्रतिक्रिया समय (कुल) 797.98s 184.47s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#145 Cobuddy

medium
No endpoints found for baidu/cobuddy:free.
लागत
$0.000
समय
0.1s
टोकन
0 tok

#122 MoonshotAI: Kimi K2.5

none
लागत
$0.015
समय
89.1s
टोकन
5,421 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Cobuddy 8.7 7.9 91.7% 1 10.00s 453 98 4,666
Kimi K2.5 3.6 8.4 8.3% 1 6.24s 652 373 0
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Cobuddy 3.7 6.7 22.2% 1 79.17s 4,726 358 30,138
Kimi K2.5 5.5 10.0 33.3% 0 24.56s 7,311 4,708 0
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Cobuddy 3.0 10.0 0.0% 0 47.38s 18,324 465 7,265
Kimi K2.5 2.8 2.1 33.3% 1 19.16s 12,264 748 0
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Cobuddy 6.3 5.8 66.7% 1 17.36s 8,181 275 5,591
Kimi K2.5 7.3 5.8 83.3% 1 42.13s 7,180 187 0
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Cobuddy 2.9 4.4 22.2% 2 128.15s 540 10 49,454
Kimi K2.5 5.3 10.0 33.3% 0 4.38s 753 29 0
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Cobuddy 4.2 9.9 0.0% 0 23.23s 498 76 3,782
Kimi K2.5 10.0 10.0 100.0% 0 4.00s 483 76 0
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Cobuddy 9.8 10.0 100.0% 0 11.60s 508 64 2,842
Kimi K2.5 6.5 10.0 50.0% 0 2.67s 677 60 0
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Cobuddy 3.6 7.2 22.2% 1 12.83s 561 189 5,808
Kimi K2.5 3.0 10.0 0.0% 0 4.04s 667 236 0
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Cobuddy 10.0 10.0 100.0% 0 11.19s 3,505 133 294
Kimi K2.5 10.0 10.0 100.0% 0 13.99s 5,835 220 0
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Cobuddy 3.0 10.0 0.0% 0 36.98s 153 9 6,863
Kimi K2.5 3.0 10.0 0.0% 0 3.90s 212 20 0

त्वरित तुलना

तुलना जोड़ी बदलें