नेव्हिगेशन
Advertise here

GPT-5.6 Luna (high) vs Qwen3.7 Max

GPT-5.6 Luna (high) average score मध्ये पुढे आहे: 8.0 vs 7.9. GPT-5.6 Luna (high) चा benchmark खर्च कमी आहे: $0.207 vs $0.492. Qwen3.7 Max वेगवान आहे: 7.85s vs 18.39s, pass rates 71.0% vs 69.6%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-01

तुलना केलेली मॉडेल्स

क्रमांक
#91
एकूण आउटपुट टोकन्स
139,395
प्रतिसाद वेळ (सरासरी)
18.39s
एकूण खर्च
$0.207
क्रमांक
#100
एकूण आउटपुट टोकन्स
20,670
प्रतिसाद वेळ (सरासरी)
7.85s
एकूण खर्च
$0.492
शिफारस केलेले मॉडेल GPT-5.6 Luna (high)

It has the best score here (8.0), while costing about 2.4x less than Qwen3.7 Max.

तपशीलवार तुलना

मेट्रिक GPT-5.6 Luna GPT-5.6 Luna high प्रकाशन: 2026-07-09 Qwen3.7 Max Qwen3.7 Max none प्रकाशन: 2026-05-22
स्कोअर 8.0 7.9
क्रमांक #91 #100
विश्वसनीयता 10.0 9.9
सुसंगतता 8.6 10.0
प्रयत्न 69/69 69/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 71.0% 69.6%
अस्थिर चाचण्या 4 0
एकूण रन 69 69
प्रति निकाल खर्च 5.882 3.070
एकूण खर्च $0.207 $0.492
इनपुट किंमत $0.200 / 1M $1.475 / 1M
आउटपुट किंमत $1.200 / 1M $4.425 / 1M
एकूण इनपुट टोकन्स 197,896 243,553
आउटपुट टोकन्स 6,211 20,670
रिझनिंग टोकन्स 133,184 0
प्रतिसाद वेळ (सरासरी) 18.39s 7.85s
प्रतिसाद वेळ (कमाल) 111.09s 80.34s
प्रतिसाद वेळ (एकूण) 422.93s 180.65s
पॅरामीटर्स ~400B एकूण (~17B सक्रिय) ~1T एकूण (~40B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#91 GPT-5.6 Luna

high
खर्च
$0.033
वेळ
34.2s
टोकन्स
5,484 tok

#100 Qwen3.7 Max

none
खर्च
$0.046
वेळ
195.0s
टोकन्स
12,171 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.6 Luna 5.5 4.7 55.6% 2 15.63s 7,302 510 17,746
Qwen3.7 Max 5.5 10.0 33.3% 0 1.35s 7,911 582 0

झटपट तुलना

तुलना जोडी बदला