नेविगेशन
AI BENCHY
Advertise here

GPT-5.6 Luna (low) vs Qwen3.5 Plus 2026-04-20

GPT-5.6 Luna (low) average score में आगे है: 6.2 vs 6.1. GPT-5.6 Luna (low) की benchmark लागत कम है: $0.051 vs $0.122. GPT-5.6 Luna (low) तेज है: 5.20s vs 13.10s, pass rates 54.5% vs 43.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-29

रैंक
#169
कुल आउटपुट टोकन
26,286
प्रतिक्रिया समय (औसत)
5.20s
कुल लागत
$0.051
रैंक
#181
कुल आउटपुट टोकन
51,487
प्रतिक्रिया समय (औसत)
13.10s
कुल लागत
$0.122
अनुशंसित मॉडल GPT-5.6 Luna (low)

It has the best score here (6.2), while costing about 2.4x less than Qwen3.5 Plus 2026-04-20.

विस्तृत तुलना

मेट्रिक GPT-5.6 Luna GPT-5.6 Luna low रिलीज़: 2026-07-09 Qwen3.5 Plus 2026-04-20 Qwen3.5 Plus 2026-04-20 none रिलीज़: 2026-04-20
स्कोर 6.2 6.1
रैंक #169 #181
विश्वसनीयता 10.0 10.0
संगति 8.2 8.7
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 54.5% 43.9%
अस्थिर टेस्ट 5 4
कुल रन 66 66
प्रति परिणाम लागत 2.437 1.636
कुल लागत $0.051 $0.122
इनपुट कीमत $0.200 / 1M $0.300 / 1M
आउटपुट कीमत $1.200 / 1M $1.800 / 1M
कुल इनपुट टोकन 96,355 94,477
आउटपुट टोकन 8,213 51,487
रीजनिंग टोकन 18,073 0
प्रतिक्रिया समय (औसत) 5.20s 13.10s
प्रतिक्रिया समय (अधिकतम) 19.44s 206.05s
प्रतिक्रिया समय (कुल) 114.46s 288.23s
पैरामीटर ~400B कुल (~17B सक्रिय) ~397B कुल (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#169 GPT-5.6 Luna

low
लागत
$0.011
समय
10.2s
टोकन
1,897 tok

#181 Qwen3.5 Plus 2026-04-20

none
लागत
$0.008
समय
77.0s
टोकन
4,369 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.6 Luna 5.5 10.0 33.3% 0 4.61s 7,302 557 3,535
Qwen3.5 Plus 2026-04-20 3.9 7.8 11.1% 1 1.69s 7,913 480 0

त्वरित तुलना

तुलना जोड़ी बदलें