नेव्हिगेशन
Advertise here

Mercury 2 (medium) vs GPT-6 Luna (low)

average score जवळपास समान आहे: 7.0 vs 7.0. GPT-6 Luna (low) चा benchmark खर्च कमी आहे: $0.020 vs $0.094. Mercury 2 (medium) वेगवान आहे: 2.95s vs 21.96s, pass rates 53.0% vs 62.1%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-09-23

तुलना केलेली मॉडेल्स

क्रमांक
#163
एकूण आउटपुट टोकन्स
87,554
प्रतिसाद वेळ (सरासरी)
2.95s
एकूण खर्च
$0.094
क्रमांक
#159
एकूण आउटपुट टोकन्स
22,605
प्रतिसाद वेळ (सरासरी)
21.96s
एकूण खर्च
$0.020
शिफारस केलेले मॉडेल Mercury 2 (medium)

It has the best score here (7.0), while responding about 7.5x faster than GPT-6 Luna (low).

तपशीलवार तुलना

मेट्रिक Mercury 2 Mercury 2 medium प्रकाशन: 2026-02-24 GPT-6 Luna GPT-6 Luna low प्रकाशन: 2026-09-23
स्कोअर 7.0 7.0
क्रमांक #163 #159
विश्वसनीयता 10.0 9.6
सुसंगतता 8.4 8.5
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 53.0% 62.1%
अस्थिर चाचण्या 4 4
एकूण रन 66 66
प्रति निकाल खर्च 0.933 0.176
एकूण खर्च $0.094 $0.020
इनपुट किंमत $0.250 / 1M $0.100 / 1M
आउटपुट किंमत $0.750 / 1M $0.500 / 1M
एकूण इनपुट टोकन्स 110,515 80,159
आउटपुट टोकन्स 10,325 4,623
रिझनिंग टोकन्स 77,229 17,982
प्रतिसाद वेळ (सरासरी) 2.95s 21.96s
प्रतिसाद वेळ (कमाल) 14.63s 89.37s
प्रतिसाद वेळ (एकूण) 61.89s 483.19s
पॅरामीटर्स ~100B ~400B एकूण (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#163 Mercury 2

medium
खर्च
$0.002
वेळ
2.1s
टोकन्स
1,702 tok

#159 GPT-6 Luna

low
खर्च
$0.002
वेळ
19.2s
टोकन्स
2,598 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Mercury 2 8.2 7.7 77.8% 1 2.04s 7,065 296 11,328
GPT-6 Luna 6.0 7.2 55.6% 1 15.39s 7,302 493 6,655

झटपट तुलना

तुलना जोडी बदला