नेविगेशन
Advertise here

GPT-5.6 Sol (high) vs Qwen3.8 Max (0902) (low)

GPT-5.6 Sol (high) average score में आगे है: 9.4 vs 9.1. GPT-5.6 Sol (high) की benchmark लागत कम है: $0.446 vs $0.664. GPT-5.6 Sol (high) तेज है: 11.48s vs 24.21s, pass rates 89.4% vs 86.4%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-07

तुलना किए गए मॉडल

रैंक
#15
कुल आउटपुट टोकन
28,708
प्रतिक्रिया समय (औसत)
11.48s
कुल लागत
$0.446
रैंक
#23
कुल आउटपुट टोकन
75,865
प्रतिक्रिया समय (औसत)
24.21s
कुल लागत
$0.664
अनुशंसित मॉडल GPT-5.6 Sol (high)

It has the best score here (9.4), while responding about 2.1x faster than Qwen3.8 Max (0902) (low).

विस्तृत तुलना

मेट्रिक GPT-5.6 Sol GPT-5.6 Sol high रिलीज़: 2026-07-09 Qwen3.8 Max (0902) Qwen3.8 Max (0902) low रिलीज़: 2026-09-07
स्कोर 9.4 9.1
रैंक #15 #23
विश्वसनीयता 10.0 10.0
संगति 8.9 9.3
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 89.4% 86.4%
अस्थिर टेस्ट 3 2
कुल रन 66 66
प्रति परिणाम लागत 6.987 3.684
कुल लागत $0.446 $0.664
इनपुट कीमत $2.000 / 1M $2.000 / 1M
आउटपुट कीमत $10.000 / 1M $6.000 / 1M
कुल इनपुट टोकन 79,258 103,954
आउटपुट टोकन 4,855 6,322
रीजनिंग टोकन 23,853 69,543
प्रतिक्रिया समय (औसत) 11.48s 24.21s
प्रतिक्रिया समय (अधिकतम) 54.79s 207.79s
प्रतिक्रिया समय (कुल) 252.62s 532.62s
पैरामीटर ~2T कुल (~150B सक्रिय) 2.4T कुल (~100B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#15 GPT-5.6 Sol

high
लागत
$0.151
समय
201.9s
टोकन
5,100 tok

#23 Qwen3.8 Max (0902)

low
लागत
$0.014
समय
41.2s
टोकन
2,421 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.6 Sol 10.0 10.0 100.0% 0 12.52s 7,302 404 5,656
Qwen3.8 Max (0902) 10.0 10.0 100.0% 0 37.42s 8,127 485 17,404

त्वरित तुलना

तुलना जोड़ी बदलें