नेव्हिगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-6 Luna (medium) vs Qwen3.5-122B-A10B (medium)

GPT-6 Luna (medium) average score मध्ये पुढे आहे: 8.3 vs 7.0. GPT-6 Luna (medium) चा benchmark खर्च कमी आहे: $0.047 vs $1.152. GPT-6 Luna (medium) वेगवान आहे: 18.07s vs 66.96s, pass rates 73.9% vs 71.0%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-09

तुलना केलेली मॉडेल्स

क्रमांक
#83
एकूण आउटपुट टोकन्स
53,161
प्रतिसाद वेळ (सरासरी)
18.07s
एकूण खर्च
$0.047
क्रमांक
#170
एकूण आउटपुट टोकन्स
522,190
प्रतिसाद वेळ (सरासरी)
66.96s
एकूण खर्च
$1.152
शिफारस केलेले मॉडेल GPT-6 Luna (medium)

It has the best score here (8.3), while costing about 24.6x less than Qwen3.5-122B-A10B (medium).

तपशीलवार तुलना

मेट्रिक GPT-6 Luna GPT-6 Luna medium प्रकाशन: 2026-09-23 Qwen3.5-122B-A10B Qwen3.5-122B-A10B medium प्रकाशन: 2026-02-24
स्कोअर 8.3 7.0
क्रमांक #83 #170
विश्वसनीयता 10.0 10.0
सुसंगतता 8.9 8.3
प्रयत्न 69/69 69/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 73.9% 71.0%
अस्थिर चाचण्या 3 5
एकूण रन 69 69
प्रति निकाल खर्च 0.313 9.196
एकूण खर्च $0.047 $1.152
इनपुट किंमत $0.100 / 1M $0.260 / 1M
आउटपुट किंमत $0.500 / 1M $2.080 / 1M
कॅश वाचण्याची किंमत $0.010 / 1M लागू नाही
कॅश लिहिण्याची किंमत $0.125 / 1M लागू नाही
एकूण इनपुट टोकन्स 203,193 251,695
आउटपुट टोकन्स 5,751 49,415
रिझनिंग टोकन्स 47,410 472,775
प्रतिसाद वेळ (सरासरी) 18.07s 66.96s
प्रतिसाद वेळ (कमाल) 66.44s 519.30s
प्रतिसाद वेळ (एकूण) 415.53s 1539.99s
पॅरामीटर्स ~400B एकूण (~17B सक्रिय) 122B एकूण (10B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#83 GPT-6 Luna

medium
खर्च
$0.002
वेळ
23.6s
टोकन्स
2,966 tok

#170 Qwen3.5-122B-A10B

medium
खर्च
$0.019
वेळ
48.7s
टोकन्स
6,034 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-6 Luna 6.6 4.6 77.8% 2 23.63s 7,302 438 10,222
Qwen3.5-122B-A10B 6.0 7.2 55.6% 1 114.48s 7,630 8,057 82,578

तुलना जोडी बदला