नेव्हिगेशन
Advertise here

GPT-6 Luna (medium) vs Qwen3.5-27B (medium)

GPT-6 Luna (medium) average score मध्ये पुढे आहे: 8.3 vs 7.9. GPT-6 Luna (medium) चा benchmark खर्च कमी आहे: $0.047 vs $1.135. GPT-6 Luna (medium) वेगवान आहे: 18.07s vs 114.73s, pass rates 73.9% vs 76.8%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-09

तुलना केलेली मॉडेल्स

क्रमांक
#83
एकूण आउटपुट टोकन्स
53,161
प्रतिसाद वेळ (सरासरी)
18.07s
एकूण खर्च
$0.047
क्रमांक
#102
एकूण आउटपुट टोकन्स
635,288
प्रतिसाद वेळ (सरासरी)
114.73s
एकूण खर्च
$1.135
शिफारस केलेले मॉडेल GPT-6 Luna (medium)

It has the best score here (8.3), while costing about 24.2x less than Qwen3.5-27B (medium).

तपशीलवार तुलना

मेट्रिक GPT-6 Luna GPT-6 Luna medium प्रकाशन: 2026-09-23 Qwen3.5-27B Qwen3.5-27B medium प्रकाशन: 2026-02-24
स्कोअर 8.3 7.9
क्रमांक #83 #102
विश्वसनीयता 10.0 10.0
सुसंगतता 8.9 7.9
प्रयत्न 69/69 69/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 73.9% 76.8%
अस्थिर चाचण्या 3 6
एकूण रन 69 69
प्रति निकाल खर्च 0.313 8.104
एकूण खर्च $0.047 $1.135
इनपुट किंमत $0.100 / 1M $0.195 / 1M
आउटपुट किंमत $0.500 / 1M $1.560 / 1M
कॅश वाचण्याची किंमत $0.010 / 1M लागू नाही
कॅश लिहिण्याची किंमत $0.125 / 1M लागू नाही
एकूण इनपुट टोकन्स 203,193 288,919
आउटपुट टोकन्स 5,751 17,484
रिझनिंग टोकन्स 47,410 617,804
प्रतिसाद वेळ (सरासरी) 18.07s 114.73s
प्रतिसाद वेळ (कमाल) 66.44s 1026.43s
प्रतिसाद वेळ (एकूण) 415.53s 2638.74s
पॅरामीटर्स ~400B एकूण (~17B सक्रिय) 27B
उपलब्धता बंद स्रोत मुक्त स्रोत

कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#83 GPT-6 Luna

medium
खर्च
$0.002
वेळ
23.6s
टोकन्स
2,966 tok

#102 Qwen3.5-27B

medium
खर्च
$0.008
वेळ
62.0s
टोकन्स
3,099 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-6 Luna 6.6 4.6 77.8% 2 23.63s 7,302 438 10,222
Qwen3.5-27B 6.2 7.1 55.6% 1 160.69s 7,895 6,381 89,388

तुलना जोडी बदला