नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Inception: Mercury 2 vs Qwen: Qwen3.5 Plus 2026-04-20

सारांश

Mercury 2 vs Qwen3.5 Plus 2026-04-20 benchmark तुलना: Qwen3.5 Plus 2026-04-20 average score मध्ये पुढे आहे: 5.5 vs 4.6. Mercury 2 चा benchmark खर्च कमी आहे: $0.011 vs $0.032. Mercury 2 वेगवान आहे: 653ms vs 4.39s, pass rates 23.8% vs 41.3%.

शिफारस केलेले मॉडेल: Mercury 2 - It offers the best overall trade-off: a competitive score (4.6), lower cost than Qwen3.5 Plus 2026-04-20, and balanced response time.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-06-18

मेट्रिक Mercury 2 Mercury 2 none प्रकाशन: 2026-02-24 Qwen3.5 Plus 2026-04-20 Qwen3.5 Plus 2026-04-20 none प्रकाशन: 2026-04-20
स्कोअर 4.6 5.5
क्रमांक #151 #122
विश्वसनीयता 10.0 10.0
सुसंगतता 9.2 8.6
बरोबर चाचण्या
प्रति प्रयत्न पास दर 23.8% 41.3%
अस्थिर चाचण्या 2 4
एकूण रन 63 63
प्रति निकाल खर्च 0.259 0.595
एकूण खर्च $0.011 $0.032
इनपुट किंमत $0.250 / 1M $0.300 / 1M
आउटपुट किंमत $0.750 / 1M $1.800 / 1M
एकूण इनपुट टोकन्स 28,113 38,910
आउटपुट टोकन्स 4,439 11,145
रिझनिंग टोकन्स 0 0
प्रतिसाद वेळ (सरासरी) 653ms 4.39s
प्रतिसाद वेळ (कमाल) 1.43s 33.34s
प्रतिसाद वेळ (एकूण) 13.72s 92.26s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#151 Mercury 2

none
खर्च
$0.002
वेळ
1.8s
टोकन्स
1,514 tok

#122 Qwen3.5 Plus 2026-04-20

none
खर्च
$0.008
वेळ
77.0s
टोकन्स
4,369 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Mercury 2 3.0 10.0 0.0% 0 483ms 631 286 0
Qwen3.5 Plus 2026-04-20 4.8 10.0 25.0% 0 1.88s 696 557 0
कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Mercury 2 3.4 9.6 0.0% 0 1.03s 7,229 3,088 0
Qwen3.5 Plus 2026-04-20 3.9 7.8 11.1% 1 1.69s 7,913 480 0
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Mercury 2 3.0 10.0 0.0% 0 606ms 4,821 131 0
Qwen3.5 Plus 2026-04-20 2.8 1.6 33.3% 1 13.32s 11,350 2,275 0
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Mercury 2 7.3 5.9 83.3% 1 667ms 6,362 180 0
Qwen3.5 Plus 2026-04-20 10.0 10.0 100.0% 0 2.82s 7,794 243 0
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Mercury 2 5.3 7.2 44.4% 1 534ms 784 46 0
Qwen3.5 Plus 2026-04-20 5.3 10.0 33.3% 0 4.43s 789 18 0
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Mercury 2 4.8 10.0 0.0% 0 628ms 495 159 0
Qwen3.5 Plus 2026-04-20 4.8 10.0 0.0% 0 1.41s 522 119 0
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Mercury 2 6.5 10.0 50.0% 0 551ms 691 82 0
Qwen3.5 Plus 2026-04-20 6.2 5.8 66.7% 1 1.17s 711 68 0
कोडी सोडवणे स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Mercury 2 3.1 10.0 0.0% 0 535ms 694 251 0
Qwen3.5 Plus 2026-04-20 6.7 7.9 55.6% 1 1.97s 714 583 0
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Mercury 2 10.0 10.0 100.0% 0 1.27s 6,193 197 0
Qwen3.5 Plus 2026-04-20 10.0 10.0 100.0% 0 4.42s 8,211 297 0
सामान्य ज्ञान स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Mercury 2 3.0 10.0 0.0% 0 548ms 213 19 0
Qwen3.5 Plus 2026-04-20 3.0 10.0 0.0% 0 33.34s 210 6,505 0

झटपट तुलना

तुलना जोडी बदला