नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY तुलना

Inception: Mercury 2 vs inclusionAI: Ring-2.6-1T

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-06-03

मेट्रिक Mercury 2 Mercury 2 none रिलीज़: 2026-02-24 Ring-2.6-1T Ring-2.6-1T medium रिलीज़: 2026-05-10
स्कोर 4.6 7.0
रैंक #153 #74
विश्वसनीयता 10.0 10.0
संगति 9.1 8.7
सही परीक्षण
प्रति प्रयास पास दर 25.0% 63.3%
अस्थिर टेस्ट 2 3
कुल रन 60 60
प्रति परिणाम लागत 0.216 0.000
कुल लागत $0.009 $0.033
इनपुट कीमत $0.250 / 1M $0.075 / 1M
आउटपुट कीमत $0.750 / 1M $0.625 / 1M
कुल इनपुट टोकन 25,515 35,892
आउटपुट टोकन 3,001 21,752
रीजनिंग टोकन 0 42,754
प्रतिक्रिया समय (औसत) 614ms 61.29s
प्रतिक्रिया समय (अधिकतम) 1.27s 304.19s
प्रतिक्रिया समय (कुल) 12.28s 1164.50s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Mercury 2 3.0 10.0 0.0% 0 483ms 631 286 0
Ring-2.6-1T 10.0 10.0 100.0% 0 42.21s 810 3,833 4,891
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Mercury 2 3.5 9.4 0.0% 0 831ms 4,631 1,650 0
Ring-2.6-1T 6.5 10.0 50.0% 0 59.65s 834 1,369 3,985
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Mercury 2 3.0 10.0 0.0% 0 606ms 4,821 131 0
Ring-2.6-1T 10.0 10.0 100.0% 0 304.19s 14,823 324 6,088
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Mercury 2 7.3 5.9 83.3% 1 667ms 6,362 180 0
Ring-2.6-1T 6.5 10.0 50.0% 0 37.36s 8,046 840 1,937
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Mercury 2 5.3 7.2 44.4% 1 534ms 784 46 0
Ring-2.6-1T 3.5 4.4 33.3% 2 64.92s 873 9,744 15,013
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Mercury 2 4.8 10.0 0.0% 0 628ms 495 159 0
Ring-2.6-1T 4.1 10.0 0.0% 0 58.26s 561 150 583
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Mercury 2 6.5 10.0 50.0% 0 551ms 691 82 0
Ring-2.6-1T 9.8 10.0 100.0% 0 11.78s 774 266 1,831
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Mercury 2 3.1 10.0 0.0% 0 535ms 694 251 0
Ring-2.6-1T 5.9 7.2 55.6% 1 20.73s 792 697 2,479
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Mercury 2 10.0 10.0 100.0% 0 1.27s 6,193 197 0
Ring-2.6-1T 10.0 10.0 100.0% 0 104.44s 8,136 234 1,531
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Mercury 2 3.0 10.0 0.0% 0 548ms 213 19 0
Ring-2.6-1T 3.0 10.0 0.0% 0 113.91s 243 4,295 4,416

त्वरित तुलना

तुलना जोड़ी बदलें