नेविगेशन
AI BENCHY
Advertise here

AI BENCHY तुलना

Cobuddy vs Inception: Mercury 2

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-06-03

मेट्रिक Cobuddy Cobuddy medium रिलीज़: 2026-05-06 Mercury 2 Mercury 2 none रिलीज़: 2026-02-24
स्कोर 5.8 4.6
रैंक #116 #153
विश्वसनीयता 10.0 10.0
संगति 7.4 9.1
सही परीक्षण
प्रति प्रयास पास दर 50.0% 25.0%
अस्थिर टेस्ट 6 2
कुल रन 60 60
प्रति परिणाम लागत 0.000 0.216
कुल लागत $0.000 $0.009
इनपुट कीमत $0.000 / 1M $0.250 / 1M
आउटपुट कीमत $0.000 / 1M $0.750 / 1M
कुल इनपुट टोकन 37,449 25,515
आउटपुट टोकन 1,677 3,001
रीजनिंग टोकन 116,703 0
प्रतिक्रिया समय (औसत) 39.90s 614ms
प्रतिक्रिया समय (अधिकतम) 309.02s 1.27s
प्रतिक्रिया समय (कुल) 797.98s 12.28s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Cobuddy 8.7 7.9 91.7% 1 10.00s 453 98 4,666
Mercury 2 3.0 10.0 0.0% 0 483ms 631 286 0
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Cobuddy 4.1 5.1 33.3% 1 79.17s 4,726 358 30,138
Mercury 2 3.5 9.4 0.0% 0 831ms 4,631 1,650 0
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Cobuddy 3.0 10.0 0.0% 0 47.38s 18,324 465 7,265
Mercury 2 3.0 10.0 0.0% 0 606ms 4,821 131 0
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Cobuddy 6.3 5.8 66.7% 1 17.36s 8,181 275 5,591
Mercury 2 7.3 5.9 83.3% 1 667ms 6,362 180 0
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Cobuddy 2.9 4.4 22.2% 2 128.15s 540 10 49,454
Mercury 2 5.3 7.2 44.4% 1 534ms 784 46 0
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Cobuddy 4.2 9.9 0.0% 0 23.23s 498 76 3,782
Mercury 2 4.8 10.0 0.0% 0 628ms 495 159 0
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Cobuddy 9.8 10.0 100.0% 0 11.60s 508 64 2,842
Mercury 2 6.5 10.0 50.0% 0 551ms 691 82 0
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Cobuddy 3.6 7.2 22.2% 1 12.83s 561 189 5,808
Mercury 2 3.1 10.0 0.0% 0 535ms 694 251 0
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Cobuddy 10.0 10.0 100.0% 0 11.19s 3,505 133 294
Mercury 2 10.0 10.0 100.0% 0 1.27s 6,193 197 0
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Cobuddy 3.0 10.0 0.0% 0 36.98s 153 9 6,863
Mercury 2 3.0 10.0 0.0% 0 548ms 213 19 0

त्वरित तुलना

तुलना जोड़ी बदलें