नेविगेशन
AI BENCHY
Your ad here

AI BENCHY तुलना

Inception: Mercury 2 vs Qwen3.6 Plus Preview

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-04-16

मेट्रिक Mercury 2 Mercury 2 none रिलीज़: 2026-02-24 Qwen3.6 Plus Preview Qwen3.6 Plus Preview medium रिलीज़: 2026-03-30 निःशुल्क उपलब्ध
स्कोर 4.8 8.5
रैंक #89 #9
संगति 9.0 10.0
सही परीक्षण
प्रति प्रयास पास दर 27.8% 76.5%
अस्थिर टेस्ट 2 0
कुल रन 54 49
प्रति परिणाम लागत 0.165 0.000
कुल लागत $0.007 $0.000
???? ??? $0.250 / 1M $0.000 / 1M
????? ??? $0.750 / 1M $0.000 / 1M
आउटपुट टोकन 1,625 1,756
रीजनिंग टोकन 0 77,213
प्रतिक्रिया समय (औसत) 613ms 13.94s
प्रतिक्रिया समय (अधिकतम) 1.27s 43.55s
प्रतिक्रिया समय (कुल) 11.04s 237.01s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Mercury 2 3.0 10.0 0.0% 0 483ms 286 0
Qwen3.6 Plus Preview 10.0 10.0 100.0% 0 9.90s 207 7,557
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Mercury 2 3.6 8.9 0.0% 0 969ms 310 0
Qwen3.6 Plus Preview - - - - - - - -
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Mercury 2 3.0 10.0 0.0% 0 606ms 131 0
Qwen3.6 Plus Preview 10.0 10.0 100.0% 0 34.95s 452 13,073
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Mercury 2 7.3 5.9 83.3% 1 667ms 180 0
Qwen3.6 Plus Preview 10.0 10.0 100.0% 0 14.95s 270 10,706
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Mercury 2 5.3 7.2 44.4% 1 534ms 46 0
Qwen3.6 Plus Preview 3.0 10.0 0.0% 0 22.08s 49 26,895
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Mercury 2 4.8 10.0 0.0% 0 628ms 159 0
Qwen3.6 Plus Preview 5.1 10.0 0.0% 0 27.05s 111 5,232
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Mercury 2 6.5 10.0 50.0% 0 551ms 82 0
Qwen3.6 Plus Preview 10.0 10.0 100.0% 0 7.54s 102 5,552
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Mercury 2 3.1 10.0 0.0% 0 533ms 234 0
Qwen3.6 Plus Preview 10.0 10.0 100.0% 0 6.11s 298 6,868
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Mercury 2 10.0 10.0 100.0% 0 1.27s 197 0
Qwen3.6 Plus Preview 10.0 10.0 100.0% 0 5.87s 267 1,330

त्वरित तुलना

तुलना जोड़ी बदलें