नेविगेशन
AI BENCHY
Advertise here

GPT-5.6 Luna vs Qwen3.6 27B

Qwen3.6 27B average score में आगे है: 5.5 vs 5.4. GPT-5.6 Luna की benchmark लागत कम है: $0.029 vs $0.116. GPT-5.6 Luna तेज है: 1.50s vs 10.62s, pass rates 36.4% vs 45.5%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-20

रैंक
#221
कुल आउटपुट टोकन
6,709
प्रतिक्रिया समय (औसत)
1.50s
कुल लागत
$0.029
रैंक
#214
कुल आउटपुट टोकन
16,156
प्रतिक्रिया समय (औसत)
10.62s
कुल लागत
$0.116
अनुशंसित मॉडल GPT-5.6 Luna

Its score stays close to the best score here (5.4 vs 5.5), while costing about 4.1x less than Qwen3.6 27B.

विस्तृत तुलना

मेट्रिक GPT-5.6 Luna GPT-5.6 Luna none रिलीज़: 2026-07-09 Qwen3.6 27B Qwen3.6 27B none रिलीज़: 2026-04-20
स्कोर 5.4 5.5
रैंक #221 #214
विश्वसनीयता 10.0 10.0
संगति 8.8 7.6
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 36.4% 45.5%
अस्थिर टेस्ट 3 6
कुल रन 66 66
प्रति परिणाम लागत 2.357 1.220
कुल लागत $0.029 $0.116
इनपुट कीमत $0.200 / 1M $0.600 / 1M
आउटपुट कीमत $1.200 / 1M $3.600 / 1M
कुल इनपुट टोकन 101,332 95,805
आउटपुट टोकन 6,709 16,156
रीजनिंग टोकन 0 0
प्रतिक्रिया समय (औसत) 1.50s 10.62s
प्रतिक्रिया समय (अधिकतम) 10.57s 156.31s
प्रतिक्रिया समय (कुल) 33.05s 233.68s
पैरामीटर ~400B कुल (~17B सक्रिय) 27B
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#221 GPT-5.6 Luna

none
लागत
$0.016
समय
15.8s
टोकन
2,685 tok

#214 Qwen3.6 27B

none
लागत
$0.009
समय
83.0s
टोकन
4,549 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.6 Luna 3.8 7.2 22.2% 1 980ms 7,302 459 0
Qwen3.6 27B 5.5 10.0 33.3% 0 4.16s 7,913 539 0

त्वरित तुलना

तुलना जोड़ी बदलें