नेव्हिगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-6 Luna (medium) vs Qwen3.8 27B (low)

average score जवळपास समान आहे: 7.9 vs 7.9. GPT-6 Luna (medium) चा benchmark खर्च कमी आहे: $0.031 vs ~$0.071. GPT-6 Luna (medium) वेगवान आहे: 15.87s vs 39.11s, pass rates 72.7% vs 68.2%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-09-23

तुलना केलेली मॉडेल्स

क्रमांक
#94
एकूण आउटपुट टोकन्स
45,154
प्रतिसाद वेळ (सरासरी)
15.87s
एकूण खर्च
$0.031
क्रमांक
#93
एकूण आउटपुट टोकन्स
169,329
प्रतिसाद वेळ (सरासरी)
39.11s
एकूण खर्च
~$0.071
शिफारस केलेले मॉडेल GPT-6 Luna (medium)

It has the best score here (7.9), while costing about 2.3x less than Qwen3.8 27B (low).

तपशीलवार तुलना

मेट्रिक GPT-6 Luna GPT-6 Luna medium प्रकाशन: 2026-09-23 Qwen3.8 27B Qwen3.8 27B low प्रकाशन: 2026-08-14
स्कोअर 7.9 7.9
क्रमांक #94 #93
विश्वसनीयता 10.0 10.0
सुसंगतता 8.9 10.0
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 72.7% 68.2%
अस्थिर चाचण्या 3 0
एकूण रन 66 66
प्रति निकाल खर्च 0.218 ~0.473
एकूण खर्च $0.031 ~$0.071
इनपुट किंमत $0.100 / 1M लागू नाही
आउटपुट किंमत $0.500 / 1M लागू नाही
एकूण इनपुट टोकन्स 78,946 99,705
आउटपुट टोकन्स 4,635 1,545
रिझनिंग टोकन्स 40,519 167,784
प्रतिसाद वेळ (सरासरी) 15.87s 39.11s
प्रतिसाद वेळ (कमाल) 35.14s 376.04s
प्रतिसाद वेळ (एकूण) 349.09s 860.51s
पॅरामीटर्स ~400B एकूण (~17B सक्रिय) 27.3B
उपलब्धता बंद स्रोत वेट्स उपलब्ध

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#94 GPT-6 Luna

medium
खर्च
$0.002
वेळ
23.6s
टोकन्स
2,966 tok

#93 Qwen3.8 27B

low
खर्च
~$0.003
वेळ
92.8s
टोकन्स
6,902 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-6 Luna 6.6 4.6 77.8% 2 23.63s 7,302 438 10,222
Qwen3.8 27B 7.7 10.0 66.7% 0 140.92s 8,127 585 86,694

झटपट तुलना

तुलना जोडी बदला

Qwen3.8 27BlowvsStep 3.7 FlashmediumGPT-5.2 ChatnonevsQwen3.8 27BlowKimi K3maxvsQwen3.8 27BlowKimi K3maxvsGPT-6 LunamediumGPT-6 LunamediumvsGrok 4.7lowGPT-5.6 TerrahighvsQwen3.8 27BlowGemini 3.5 Flash LitemediumvsQwen3.8 27BlowQwen3.8 27BlowvsGLM 5.2mediumQwen3.8 27BlowvsInklingmediumGPT-5.6 TerramediumvsQwen3.8 27BlowClaude Sonnet 4.6mediumvsQwen3.8 27BlowQwen3.8 27BlowvsGLM 5.2high