नेव्हिगेशन
Advertise here

GPT-6 Luna (high) vs Qwen3.8 Flash Next (medium)

GPT-6 Luna (high) average score मध्ये पुढे आहे: 7.7 vs 7.6. Qwen3.8 Flash Next (medium) चा benchmark खर्च कमी आहे: ~$0.047 vs $0.074. GPT-6 Luna (high) वेगवान आहे: 20.37s vs 24.79s, pass rates 73.9% vs 75.4%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-05

तुलना केलेली मॉडेल्स

क्रमांक
#114
एकूण आउटपुट टोकन्स
101,587
प्रतिसाद वेळ (सरासरी)
20.37s
एकूण खर्च
$0.074
क्रमांक
#119
एकूण आउटपुट टोकन्स
143,965
प्रतिसाद वेळ (सरासरी)
24.79s
एकूण खर्च
~$0.047
शिफारस केलेले मॉडेल GPT-6 Luna (high)

It has the strongest score in this comparison (7.7) and the best overall balance of cost and response time across all 2 models.

तपशीलवार तुलना

मेट्रिक GPT-6 Luna GPT-6 Luna high प्रकाशन: 2026-09-23 Qwen3.8 Flash Next Qwen3.8 Flash Next medium प्रकाशन: 2026-10-04
स्कोअर 7.7 7.6
क्रमांक #114 #119
विश्वसनीयता 10.0 10.0
सुसंगतता 8.7 7.9
प्रयत्न 69/69 69/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 73.9% 75.4%
अस्थिर चाचण्या 4 6
एकूण रन 69 69
प्रति निकाल खर्च 0.492 ~0.314
एकूण खर्च $0.074 ~$0.047
इनपुट किंमत $0.100 / 1M लागू नाही
आउटपुट किंमत $0.500 / 1M लागू नाही
कॅश वाचण्याची किंमत $0.010 / 1M लागू नाही
कॅश लिहिण्याची किंमत $0.125 / 1M लागू नाही
एकूण इनपुट टोकन्स 229,986 278,792
आउटपुट टोकन्स 6,037 1,695
रिझनिंग टोकन्स 95,550 142,270
प्रतिसाद वेळ (सरासरी) 20.37s 24.79s
प्रतिसाद वेळ (कमाल) 106.93s 159.62s
प्रतिसाद वेळ (एकूण) 468.52s 570.26s
पॅरामीटर्स ~400B एकूण (~17B सक्रिय) 180B एकूण (6B सक्रिय)
उपलब्धता बंद स्रोत वेट्स उपलब्ध

कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#114 GPT-6 Luna

high
खर्च
$0.003
वेळ
49.2s
टोकन्स
5,231 tok

#119 Qwen3.8 Flash Next

medium
खर्च
~$0.002
वेळ
40.7s
टोकन्स
4,059 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-6 Luna 7.8 7.4 77.8% 1 24.69s 7,302 483 15,691
Qwen3.8 Flash Next 10.0 10.0 100.0% 0 45.53s 7,893 346 37,643

झटपट तुलना

तुलना जोडी बदला