नेविगेशन
Advertise here

GPT-6 Luna (high) vs Qwen3.5 Plus 2026-04-20 (medium)

average score लगभग बराबर है: 7.7 vs 7.7. GPT-6 Luna (high) की benchmark लागत कम है: $0.074 vs $0.488. GPT-6 Luna (high) तेज है: 20.37s vs 54.06s, pass rates 73.9% vs 65.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#111
कुल आउटपुट टोकन
101,587
प्रतिक्रिया समय (औसत)
20.37s
कुल लागत
$0.074
रैंक
#113
कुल आउटपुट टोकन
200,348
प्रतिक्रिया समय (औसत)
54.06s
कुल लागत
$0.488
अनुशंसित मॉडल GPT-6 Luna (high)

It has the best score here (7.7), while costing about 6.6x less than Qwen3.5 Plus 2026-04-20 (medium).

विस्तृत तुलना

मेट्रिक GPT-6 Luna GPT-6 Luna high रिलीज़: 2026-09-23 Qwen3.5 Plus 2026-04-20 Qwen3.5 Plus 2026-04-20 medium रिलीज़: 2026-04-20
स्कोर 7.7 7.7
रैंक #111 #113
विश्वसनीयता 10.0 9.7
संगति 8.7 9.1
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 73.9% 65.2%
अस्थिर टेस्ट 4 2
कुल रन 69 69
प्रति परिणाम लागत 0.492 3.481
कुल लागत $0.074 $0.488
इनपुट कीमत $0.100 / 1M $0.300 / 1M
आउटपुट कीमत $0.500 / 1M $1.800 / 1M
कुल इनपुट टोकन 229,986 176,539
आउटपुट टोकन 6,037 4,419
रीजनिंग टोकन 95,550 195,929
प्रतिक्रिया समय (औसत) 20.37s 54.06s
प्रतिक्रिया समय (अधिकतम) 106.93s 203.01s
प्रतिक्रिया समय (कुल) 468.52s 1189.36s
पैरामीटर ~400B कुल (~17B सक्रिय) ~397B कुल (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#111 GPT-6 Luna

high
लागत
$0.003
समय
49.2s
टोकन
5,231 tok

#113 Qwen3.5 Plus 2026-04-20

medium
लागत
$0.008
समय
76.7s
टोकन
4,355 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-6 Luna 7.8 7.4 77.8% 1 24.69s 7,302 483 15,691
Qwen3.5 Plus 2026-04-20 6.2 8.7 33.3% 0 125.25s 7,630 308 58,682

त्वरित तुलना

तुलना जोड़ी बदलें