नेविगेशन
Advertise here

GPT-6 Luna vs Qwen3.5-122B-A10B

Qwen3.5-122B-A10B average score में आगे है: 5.7 vs 5.6. GPT-6 Luna की benchmark लागत कम है: $0.012 vs $0.247. Qwen3.5-122B-A10B तेज है: 12.93s vs 19.08s, pass rates 42.4% vs 33.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-23

तुलना किए गए मॉडल

रैंक
#260
कुल आउटपुट टोकन
5,508
प्रतिक्रिया समय (औसत)
19.08s
कुल लागत
$0.012
रैंक
#255
कुल आउटपुट टोकन
88,459
प्रतिक्रिया समय (औसत)
12.93s
कुल लागत
$0.247
अनुशंसित मॉडल GPT-6 Luna

Its score stays close to the best score here (5.6 vs 5.7), while costing about 21.5x less than Qwen3.5-122B-A10B.

विस्तृत तुलना

मेट्रिक GPT-6 Luna GPT-6 Luna none रिलीज़: 2026-09-23 Qwen3.5-122B-A10B Qwen3.5-122B-A10B none रिलीज़: 2026-02-24
स्कोर 5.6 5.7
रैंक #260 #255
विश्वसनीयता 9.9 10.0
संगति 8.1 9.3
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 42.4% 33.3%
अस्थिर टेस्ट 5 2
कुल रन 66 66
प्रति परिणाम लागत 0.164 4.182
कुल लागत $0.012 $0.247
इनपुट कीमत $0.100 / 1M $0.260 / 1M
आउटपुट कीमत $0.500 / 1M $2.080 / 1M
कुल इनपुट टोकन 87,216 241,575
आउटपुट टोकन 5,508 88,459
रीजनिंग टोकन 0 0
प्रतिक्रिया समय (औसत) 19.08s 12.93s
प्रतिक्रिया समय (अधिकतम) 98.62s 212.63s
प्रतिक्रिया समय (कुल) 419.83s 284.39s
पैरामीटर ~400B कुल (~17B सक्रिय) 122B कुल (10B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#260 GPT-6 Luna

none
लागत
$0.002
समय
26.0s
टोकन
3,235 tok

#255 Qwen3.5-122B-A10B

none
लागत
$0.016
समय
44.5s
टोकन
6,431 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-6 Luna 5.5 10.0 33.3% 0 8.04s 7,302 376 0
Qwen3.5-122B-A10B 3.7 7.0 22.2% 1 2.77s 7,913 693 0

त्वरित तुलना

तुलना जोड़ी बदलें