AI BENCHY तुलना
Inception: Mercury 2 vs Owl Alpha
बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-06-03
| मेट्रिक | Mercury 2 Mercury 2 none | Owl Alpha Owl Alpha medium |
|---|---|---|
| स्कोर | 4.6 | 5.8 |
| रैंक | #153 | #107 |
| विश्वसनीयता | 10.0 | 10.0 |
| संगति | 9.1 | 9.6 |
| सही परीक्षण | ||
| प्रति प्रयास पास दर | 25.0% | 41.7% |
| अस्थिर टेस्ट | 2 | 1 |
| कुल रन | 60 | 60 |
| प्रति परिणाम लागत | 0.216 | 0.000 |
| कुल लागत | $0.009 | $0.000 |
| इनपुट कीमत | $0.250 / 1M | $0.000 / 1M |
| आउटपुट कीमत | $0.750 / 1M | $0.000 / 1M |
| कुल इनपुट टोकन | 25,515 | 40,601 |
| आउटपुट टोकन | 3,001 | 2,965 |
| रीजनिंग टोकन | 0 | 0 |
| प्रतिक्रिया समय (औसत) | 614ms | 11.64s |
| प्रतिक्रिया समय (अधिकतम) | 1.27s | 58.63s |
| प्रतिक्रिया समय (कुल) | 12.28s | 232.83s |
स्कोर बनाम कुल लागत
प्रतिक्रिया समय (औसत)
स्कोर vs प्रतिक्रिया समय (औसत)
कुल आउटपुट टोकन
स्कोर vs कुल आउटपुट टोकन
श्रेणी विवरण
त्वरित तुलना
तुलना जोड़ी बदलें
Owl AlphamediumvsGLM 5.1noneDeepSeek V4 PrononevsOwl AlphamediumOwl AlphamediumvsQwen3.5 Plus 2026-04-20noneSeed-2.0-LitenonevsOwl AlphamediumOwl AlphamediumvsQwen3.5-35B-A3BnoneOwl AlphamediumvsGLM 5V TurbononeOwl AlphamediumvsQwen3.5-27BnoneOwl AlphamediumvsQwen3.6 27BnoneOwl AlphamediumvsQwen3.5-FlashnoneMercury 2nonevsQwen3 Coder NextmediumOwl AlphamediumvsMimo V2 PROnoneMercury 2nonevsGLM 4.7 Flashmedium