नेव्हिगेशन
Advertise here

Mercury 2.5 (high) vs Qwen3.5-122B-A10B

average score जवळपास समान आहे: 6.5 vs 6.4. Mercury 2.5 (high) चा benchmark खर्च कमी आहे: $0.044 vs $0.308. Mercury 2.5 (high) वेगवान आहे: 7.62s vs 14.79s, pass rates 59.4% vs 36.2%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-01

तुलना केलेली मॉडेल्स

क्रमांक
#195
एकूण आउटपुट टोकन्स
193,676
प्रतिसाद वेळ (सरासरी)
7.62s
एकूण खर्च
$0.044
क्रमांक
#201
एकूण आउटपुट टोकन्स
97,112
प्रतिसाद वेळ (सरासरी)
14.79s
एकूण खर्च
$0.308
शिफारस केलेले मॉडेल Mercury 2.5 (high)

It has the best score here (6.5), while costing about 7.1x less than Qwen3.5-122B-A10B.

तपशीलवार तुलना

मेट्रिक Mercury 2.5 Mercury 2.5 high प्रकाशन: 2026-09-08 Qwen3.5-122B-A10B Qwen3.5-122B-A10B none प्रकाशन: 2026-02-24
स्कोअर 6.5 6.4
क्रमांक #195 #201
विश्वसनीयता 9.8 10.0
सुसंगतता 8.7 9.3
प्रयत्न 69/69 69/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 59.4% 36.2%
अस्थिर चाचण्या 4 2
एकूण रन 69 69
प्रति निकाल खर्च 0.362 4.452
एकूण खर्च $0.044 $0.308
इनपुट किंमत $0.040 / 1M $0.260 / 1M
आउटपुट किंमत $0.150 / 1M $2.080 / 1M
एकूण इनपुट टोकन्स 358,562 405,921
आउटपुट टोकन्स 4,266 97,112
रिझनिंग टोकन्स 189,410 0
प्रतिसाद वेळ (सरासरी) 7.62s 14.79s
प्रतिसाद वेळ (कमाल) 80.30s 212.63s
प्रतिसाद वेळ (एकूण) 175.36s 340.25s
पॅरामीटर्स ~100B 122B एकूण (10B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#195 Mercury 2.5

high
खर्च
$0.001
वेळ
3.5s
टोकन्स
2,447 tok

#201 Qwen3.5-122B-A10B

none
खर्च
$0.016
वेळ
44.5s
टोकन्स
6,431 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Mercury 2.5 6.4 7.8 44.4% 1 6.58s 7,757 415 44,012
Qwen3.5-122B-A10B 3.7 7.0 22.2% 1 2.77s 7,913 693 0

झटपट तुलना

तुलना जोडी बदला