नेविगेशन
AI BENCHY
Advertise here

GPT-5.6 Luna (low) vs Qwen3.5-35B-A3B (medium)

average score लगभग बराबर है: 6.2 vs 6.1. GPT-5.6 Luna (low) की benchmark लागत कम है: $0.051 vs $1.140. GPT-5.6 Luna (low) तेज है: 5.20s vs 110.84s, pass rates 54.5% vs 65.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-20

रैंक
#167
कुल आउटपुट टोकन
26,286
प्रतिक्रिया समय (औसत)
5.20s
कुल लागत
$0.051
रैंक
#170
कुल आउटपुट टोकन
893,463
प्रतिक्रिया समय (औसत)
110.84s
कुल लागत
$1.140
अनुशंसित मॉडल GPT-5.6 Luna (low)

It has the best score here (6.2), while costing about 22.4x less than Qwen3.5-35B-A3B (medium).

विस्तृत तुलना

मेट्रिक GPT-5.6 Luna GPT-5.6 Luna low रिलीज़: 2026-07-09 Qwen3.5-35B-A3B Qwen3.5-35B-A3B medium रिलीज़: 2026-02-24
स्कोर 6.2 6.1
रैंक #167 #170
विश्वसनीयता 10.0 10.0
संगति 8.2 7.6
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 54.5% 65.2%
अस्थिर टेस्ट 5 6
कुल रन 66 66
प्रति परिणाम लागत 2.437 9.806
कुल लागत $0.051 $1.140
इनपुट कीमत $0.200 / 1M $0.250 / 1M
आउटपुट कीमत $1.200 / 1M $1.250 / 1M
कुल इनपुट टोकन 96,355 130,450
आउटपुट टोकन 8,213 54,857
रीजनिंग टोकन 18,073 838,606
प्रतिक्रिया समय (औसत) 5.20s 110.84s
प्रतिक्रिया समय (अधिकतम) 19.44s 950.25s
प्रतिक्रिया समय (कुल) 114.46s 2438.58s
पैरामीटर ~400B कुल (~17B सक्रिय) 35B कुल (3B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#167 GPT-5.6 Luna

low
लागत
$0.011
समय
10.2s
टोकन
1,897 tok

#170 Qwen3.5-35B-A3B

medium
लागत
$0.009
समय
71.4s
टोकन
8,631 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.6 Luna 5.5 10.0 33.3% 0 4.61s 7,302 557 3,535
Qwen3.5-35B-A3B 5.9 9.3 33.3% 0 206.65s 4,106 23,844 111,462

त्वरित तुलना

तुलना जोड़ी बदलें