नेविगेशन
Advertise here

GPT-5.6 Sol (medium) vs Qwen3.8 Max (0902) (low)

GPT-5.6 Sol (medium) average score में आगे है: 9.4 vs 9.1. GPT-5.6 Sol (medium) की benchmark लागत कम है: $0.508 vs $0.664. GPT-5.6 Sol (medium) तेज है: 12.63s vs 24.21s, pass rates 90.9% vs 86.4%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-18

तुलना किए गए मॉडल

रैंक
#13
कुल आउटपुट टोकन
34,977
प्रतिक्रिया समय (औसत)
12.63s
कुल लागत
$0.508
रैंक
#23
कुल आउटपुट टोकन
75,865
प्रतिक्रिया समय (औसत)
24.21s
कुल लागत
$0.664
अनुशंसित मॉडल GPT-5.6 Sol (medium)

It has the best score here (9.4), while responding about 1.9x faster than Qwen3.8 Max (0902) (low).

विस्तृत तुलना

मेट्रिक GPT-5.6 Sol GPT-5.6 Sol medium रिलीज़: 2026-07-09 Qwen3.8 Max (0902) Qwen3.8 Max (0902) low रिलीज़: 2026-09-07
स्कोर 9.4 9.1
रैंक #13 #23
विश्वसनीयता 10.0 10.0
संगति 8.9 9.3
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 90.9% 86.4%
अस्थिर टेस्ट 3 2
कुल रन 66 66
प्रति परिणाम लागत 8.025 3.684
कुल लागत $0.508 $0.664
इनपुट कीमत $2.000 / 1M $2.000 / 1M
आउटपुट कीमत $10.000 / 1M $6.000 / 1M
कुल इनपुट टोकन 79,006 103,954
आउटपुट टोकन 4,696 6,322
रीजनिंग टोकन 30,281 69,543
प्रतिक्रिया समय (औसत) 12.63s 24.21s
प्रतिक्रिया समय (अधिकतम) 79.40s 207.79s
प्रतिक्रिया समय (कुल) 277.88s 532.62s
पैरामीटर ~2T कुल (~150B सक्रिय) 2.4T कुल (~100B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#13 GPT-5.6 Sol

medium
लागत
$0.124
समय
57.2s
टोकन
4,199 tok

#23 Qwen3.8 Max (0902)

low
लागत
$0.014
समय
41.2s
टोकन
2,421 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.6 Sol 10.0 10.0 100.0% 0 9.40s 7,302 394 4,706
Qwen3.8 Max (0902) 10.0 10.0 100.0% 0 37.42s 8,127 485 17,404

त्वरित तुलना

तुलना जोड़ी बदलें