नेव्हिगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-5.6 Luna (high) vs Qwen3.5-27B (medium)

GPT-5.6 Luna (high) average score मध्ये पुढे आहे: 8.0 vs 7.9. GPT-5.6 Luna (high) चा benchmark खर्च कमी आहे: $0.118 vs $1.135. GPT-5.6 Luna (high) वेगवान आहे: 18.39s vs 114.73s, pass rates 71.0% vs 76.8%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-07

तुलना केलेली मॉडेल्स

क्रमांक
#96
एकूण आउटपुट टोकन्स
139,395
प्रतिसाद वेळ (सरासरी)
18.39s
एकूण खर्च
$0.118
क्रमांक
#102
एकूण आउटपुट टोकन्स
635,288
प्रतिसाद वेळ (सरासरी)
114.73s
एकूण खर्च
$1.135
शिफारस केलेले मॉडेल GPT-5.6 Luna (high)

It has the best score here (8.0), while costing about 9.6x less than Qwen3.5-27B (medium).

तपशीलवार तुलना

मेट्रिक GPT-5.6 Luna GPT-5.6 Luna high प्रकाशन: 2026-07-09 Qwen3.5-27B Qwen3.5-27B medium प्रकाशन: 2026-02-24
स्कोअर 8.0 7.9
क्रमांक #96 #102
विश्वसनीयता 10.0 10.0
सुसंगतता 8.6 7.9
प्रयत्न 69/69 69/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 71.0% 76.8%
अस्थिर चाचण्या 4 6
एकूण रन 69 69
प्रति निकाल खर्च 5.882 8.104
एकूण खर्च $0.118 $1.135
इनपुट किंमत $0.200 / 1M $0.195 / 1M
आउटपुट किंमत $1.200 / 1M $1.560 / 1M
कॅश वाचण्याची किंमत $0.020 / 1M लागू नाही
कॅश लिहिण्याची किंमत $0.250 / 1M लागू नाही
एकूण इनपुट टोकन्स 197,896 288,919
आउटपुट टोकन्स 6,211 17,484
रिझनिंग टोकन्स 133,184 617,804
प्रतिसाद वेळ (सरासरी) 18.39s 114.73s
प्रतिसाद वेळ (कमाल) 111.09s 1026.43s
प्रतिसाद वेळ (एकूण) 422.93s 2638.74s
पॅरामीटर्स ~400B एकूण (~17B सक्रिय) 27B
उपलब्धता बंद स्रोत मुक्त स्रोत

कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#96 GPT-5.6 Luna

high
खर्च
$0.033
वेळ
34.2s
टोकन्स
5,484 tok

#102 Qwen3.5-27B

medium
खर्च
$0.008
वेळ
62.0s
टोकन्स
3,099 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.6 Luna 5.5 4.7 55.6% 2 15.63s 7,302 510 17,746
Qwen3.5-27B 6.2 7.1 55.6% 1 160.69s 7,895 6,381 89,388

तुलना जोडी बदला