नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-5.6 Luna (medium) vs Qwen3.7 Max

average score लगभग बराबर है: 7.4 vs 7.4. GPT-5.6 Luna (medium) की benchmark लागत कम है: $0.072 vs $0.197. Qwen3.7 Max तेज है: 4.56s vs 7.43s, pass rates 62.1% vs 68.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-29

रैंक
#94
कुल आउटपुट टोकन
44,525
प्रतिक्रिया समय (औसत)
7.43s
कुल लागत
$0.072
रैंक
#92
कुल आउटपुट टोकन
12,446
प्रतिक्रिया समय (औसत)
4.56s
कुल लागत
$0.197
अनुशंसित मॉडल GPT-5.6 Luna (medium)

It has the best score here (7.4), while costing about 2.8x less than Qwen3.7 Max.

विस्तृत तुलना

मेट्रिक GPT-5.6 Luna GPT-5.6 Luna medium रिलीज़: 2026-07-09 Qwen3.7 Max Qwen3.7 Max none रिलीज़: 2026-05-22
स्कोर 7.4 7.4
रैंक #94 #92
विश्वसनीयता 10.0 9.9
संगति 9.2 10.0
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 62.1% 68.2%
अस्थिर टेस्ट 2 0
कुल रन 66 66
प्रति परिणाम लागत 2.601 1.581
कुल लागत $0.072 $0.197
इनपुट कीमत $0.200 / 1M $1.475 / 1M
आउटपुट कीमत $1.200 / 1M $4.425 / 1M
कुल इनपुट टोकन 89,685 95,992
आउटपुट टोकन 5,701 12,446
रीजनिंग टोकन 38,824 0
प्रतिक्रिया समय (औसत) 7.43s 4.56s
प्रतिक्रिया समय (अधिकतम) 29.85s 72.30s
प्रतिक्रिया समय (कुल) 163.54s 100.30s
पैरामीटर ~400B कुल (~17B सक्रिय) ~1T कुल (~40B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#94 GPT-5.6 Luna

medium
लागत
$0.014
समय
14.6s
टोकन
2,362 tok

#92 Qwen3.7 Max

none
लागत
$0.046
समय
195.0s
टोकन
12,171 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.6 Luna 5.4 7.2 44.4% 1 10.38s 7,302 564 9,928
Qwen3.7 Max 5.5 10.0 33.3% 0 1.35s 7,911 582 0

त्वरित तुलना

तुलना जोड़ी बदलें