नेविगेशन
AI BENCHY
Advertise here

AI BENCHY तुलना

Google: Gemini 3.5 Flash vs Inception: Mercury 2

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-06-03

मेट्रिक Gemini 3.5 Flash Gemini 3.5 Flash high रिलीज़: 2026-05-19 Mercury 2 Mercury 2 none रिलीज़: 2026-02-24
स्कोर 9.6 4.6
रैंक #2 #153
विश्वसनीयता 10.0 10.0
संगति 9.6 9.1
सही परीक्षण
प्रति प्रयास पास दर 96.7% 25.0%
अस्थिर टेस्ट 1 2
कुल रन 60 60
प्रति परिणाम लागत 5.231 0.216
कुल लागत $0.994 $0.009
इनपुट कीमत $1.500 / 1M $0.250 / 1M
आउटपुट कीमत $9.000 / 1M $0.750 / 1M
कुल इनपुट टोकन 34,591 25,515
आउटपुट टोकन 1,969 3,001
रीजनिंग टोकन 102,679 0
प्रतिक्रिया समय (औसत) 8.30s 614ms
प्रतिक्रिया समय (अधिकतम) 34.82s 1.27s
प्रतिक्रिया समय (कुल) 165.92s 12.28s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.57s 492 174 4,997
Mercury 2 3.0 10.0 0.0% 0 483ms 631 286 0
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.5 Flash 10.0 10.0 100.0% 0 24.62s 5,115 450 34,170
Mercury 2 3.5 9.4 0.0% 0 831ms 4,631 1,650 0
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.5 Flash 10.0 10.0 100.0% 0 22.37s 12,873 351 16,323
Mercury 2 3.0 10.0 0.0% 0 606ms 4,821 131 0
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.5 Flash 10.0 10.0 100.0% 0 6.43s 7,548 279 8,466
Mercury 2 7.3 5.9 83.3% 1 667ms 6,362 180 0
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.5 Flash 7.6 7.2 77.8% 1 14.09s 633 12 24,721
Mercury 2 5.3 7.2 44.4% 1 534ms 784 46 0
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.63s 486 115 1,650
Mercury 2 4.8 10.0 0.0% 0 628ms 495 159 0
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.35s 615 70 3,799
Mercury 2 6.5 10.0 50.0% 0 551ms 691 82 0
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.23s 558 241 4,940
Mercury 2 3.1 10.0 0.0% 0 535ms 694 251 0
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.5 Flash 9.8 10.0 100.0% 0 4.96s 6,115 265 1,608
Mercury 2 10.0 10.0 100.0% 0 1.27s 6,193 197 0
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.94s 156 12 2,005
Mercury 2 3.0 10.0 0.0% 0 548ms 213 19 0

त्वरित तुलना

तुलना जोड़ी बदलें