नेविगेशन
Advertise here

GPT-6 Sol vs Qwen3.5-122B-A10B (medium)

average score लगभग बराबर है: 7.2 vs 7.1. GPT-6 Sol की benchmark लागत कम है: $0.280 vs $1.047. GPT-6 Sol तेज है: 6.84s vs 65.67s, pass rates 66.7% vs 71.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-23

तुलना किए गए मॉडल

रैंक
#148
कुल आउटपुट टोकन
6,696
प्रतिक्रिया समय (औसत)
6.84s
कुल लागत
$0.280
रैंक
#152
कुल आउटपुट टोकन
487,519
प्रतिक्रिया समय (औसत)
65.67s
कुल लागत
$1.047
अनुशंसित मॉडल GPT-6 Sol

It has the best score here (7.2), while costing about 3.7x less than Qwen3.5-122B-A10B (medium).

विस्तृत तुलना

मेट्रिक GPT-6 Sol GPT-6 Sol none रिलीज़: 2026-09-23 Qwen3.5-122B-A10B Qwen3.5-122B-A10B medium रिलीज़: 2026-02-24
स्कोर 7.2 7.1
रैंक #148 #152
विश्वसनीयता 10.0 10.0
संगति 8.5 8.5
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 66.7% 71.2%
अस्थिर टेस्ट 4 4
कुल रन 66 66
प्रति परिणाम लागत 2.151 8.446
कुल लागत $0.280 $1.047
इनपुट कीमत $2.000 / 1M $0.260 / 1M
आउटपुट कीमत $10.000 / 1M $2.080 / 1M
कुल इनपुट टोकन 106,332 124,780
आउटपुट टोकन 6,696 47,694
रीजनिंग टोकन 0 439,825
प्रतिक्रिया समय (औसत) 6.84s 65.67s
प्रतिक्रिया समय (अधिकतम) 23.89s 519.30s
प्रतिक्रिया समय (कुल) 150.43s 1444.68s
पैरामीटर ~2T कुल (~150B सक्रिय) 122B कुल (10B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#148 GPT-6 Sol

none
लागत
$0.030
समय
31.9s
टोकन
3,055 tok

#152 Qwen3.5-122B-A10B

medium
लागत
$0.019
समय
48.7s
टोकन
6,034 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-6 Sol 5.5 10.0 33.3% 0 12.23s 7,302 389 0
Qwen3.5-122B-A10B 6.0 7.2 55.6% 1 114.48s 7,630 8,057 82,578

त्वरित तुलना

तुलना जोड़ी बदलें