नेव्हिगेशन
AI BENCHY
Advertise here

GPT-5.6 Luna vs Qwen3.8 27B

Qwen3.8 27B average score मध्ये पुढे आहे: 5.5 vs 5.4. स्थानिक हार्डवेअरचा खर्च मोजला नाही, त्यामुळे खर्चाची तुलना उपलब्ध नाही. GPT-5.6 Luna वेगवान आहे: 1.50s vs 3.12s, pass rates 36.4% vs 40.9%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-15

क्रमांक
#216
एकूण आउटपुट टोकन्स
6,709
प्रतिसाद वेळ (सरासरी)
1.50s
एकूण खर्च
$0.015
क्रमांक
#211
एकूण आउटपुट टोकन्स
11,445
प्रतिसाद वेळ (सरासरी)
3.12s
एकूण खर्च
लागू नाही
शिफारस केलेले मॉडेल GPT-5.6 Luna

Its score stays close to the best score here (5.4 vs 5.5), while responding about 2.1x faster than Qwen3.8 27B.

तपशीलवार तुलना

मेट्रिक GPT-5.6 Luna GPT-5.6 Luna none प्रकाशन: 2026-07-09 Qwen3.8 27B Qwen3.8 27B none प्रकाशन: 2026-08-14
स्कोअर 5.4 5.5
क्रमांक #216 #211
विश्वसनीयता 10.0 10.0
सुसंगतता 8.8 10.0
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 36.4% 40.9%
अस्थिर चाचण्या 3 0
एकूण रन 66 66
प्रति निकाल खर्च 2.357 लागू नाही
एकूण खर्च $0.015 लागू नाही
इनपुट किंमत $0.100 / 1M लागू नाही
आउटपुट किंमत $0.600 / 1M लागू नाही
एकूण इनपुट टोकन्स 101,332 122,463
आउटपुट टोकन्स 6,709 11,445
रिझनिंग टोकन्स 0 0
प्रतिसाद वेळ (सरासरी) 1.50s 3.12s
प्रतिसाद वेळ (कमाल) 10.57s 44.76s
प्रतिसाद वेळ (एकूण) 33.05s 68.69s
पॅरामीटर्स ~400B एकूण (~17B सक्रिय) 27.3B
उपलब्धता बंद स्रोत वेट्स उपलब्ध

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#216 GPT-5.6 Luna

none
खर्च
$0.016
वेळ
15.8s
टोकन्स
2,685 tok

#211 Qwen3.8 27B

none
खर्च
लागू नाही
वेळ
23.9s
टोकन्स
1,922 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.6 Luna 3.8 7.2 22.2% 1 980ms 7,302 459 0
Qwen3.8 27B 5.5 10.0 33.3% 0 1.19s 7,911 408 0

झटपट तुलना

तुलना जोडी बदला

KAT-Coder-Air V2.5lowvsGPT-5.6 LunanoneGPT-5.6 LunanonevsLaguna S 2.1mediumमोफत उपलब्धNemotron 3.5 Lightninghighमोफत उपलब्धvsQwen3.8 27BnoneGPT-5.6 LunanonevsLaguna S 2.1highमोफत उपलब्धKAT-Coder-Air V2.5mediumvsQwen3.8 27BnoneLaguna S 2.1mediumमोफत उपलब्धvsQwen3.8 27BnoneKAT-Coder-Air V2.5highvsQwen3.8 27BnoneKAT-Coder-Air V2.5lowvsQwen3.8 27BnoneNemotron 3.5 Lightninghighमोफत उपलब्धvsGPT-5.6 LunanoneLaguna S 2.1highमोफत उपलब्धvsQwen3.8 27BnoneKAT-Coder-Air V2.5mediumvsGPT-5.6 LunanoneQwen3.8 27BnonevsInkling Smalllow