नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY तुलना

Google: Gemini 3.5 Flash vs Inception: Mercury 2

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-06-03

मेट्रिक Gemini 3.5 Flash Gemini 3.5 Flash low रिलीज़: 2026-05-19 Mercury 2 Mercury 2 none रिलीज़: 2026-02-24
स्कोर 9.3 4.6
रैंक #3 #153
विश्वसनीयता 10.0 10.0
संगति 10.0 9.1
सही परीक्षण
प्रति प्रयास पास दर 90.0% 25.0%
अस्थिर टेस्ट 0 2
कुल रन 60 60
प्रति परिणाम लागत 1.582 0.216
कुल लागत $0.285 $0.009
इनपुट कीमत $1.500 / 1M $0.250 / 1M
आउटपुट कीमत $9.000 / 1M $0.750 / 1M
कुल इनपुट टोकन 33,935 25,515
आउटपुट टोकन 2,027 3,001
रीजनिंग टोकन 23,938 0
प्रतिक्रिया समय (औसत) 2.98s 614ms
प्रतिक्रिया समय (अधिकतम) 6.44s 1.27s
प्रतिक्रिया समय (कुल) 59.59s 12.28s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.52s 494 209 2,536
Mercury 2 3.0 10.0 0.0% 0 483ms 631 286 0
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.5 Flash 6.8 10.0 50.0% 0 5.54s 5,115 452 6,839
Mercury 2 3.5 9.4 0.0% 0 831ms 4,631 1,650 0
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.5 Flash 10.0 10.0 100.0% 0 6.44s 12,873 351 3,050
Mercury 2 3.0 10.0 0.0% 0 606ms 4,821 131 0
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.5 Flash 10.0 10.0 100.0% 0 1.81s 7,548 279 1,164
Mercury 2 7.3 5.9 83.3% 1 667ms 6,362 180 0
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.5 Flash 7.7 10.0 66.7% 0 3.39s 633 12 4,538
Mercury 2 5.3 7.2 44.4% 1 534ms 784 46 0
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.27s 486 119 916
Mercury 2 4.8 10.0 0.0% 0 628ms 495 159 0
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.5 Flash 9.9 10.0 100.0% 0 1.86s 615 71 1,652
Mercury 2 6.5 10.0 50.0% 0 551ms 691 82 0
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.35s 558 288 2,150
Mercury 2 3.1 10.0 0.0% 0 535ms 694 251 0
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.27s 5,457 234 403
Mercury 2 10.0 10.0 100.0% 0 1.27s 6,193 197 0
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.5 Flash 10.0 10.0 100.0% 0 1.88s 156 12 690
Mercury 2 3.0 10.0 0.0% 0 548ms 213 19 0

त्वरित तुलना

तुलना जोड़ी बदलें