नेविगेशन
Advertise here

GPT-6 Sol (medium) vs Qwen3.8 Max (0902) (low)

GPT-6 Sol (medium) average score में आगे है: 9.4 vs 9.1. GPT-6 Sol (medium) की benchmark लागत कम है: $0.448 vs $0.664. GPT-6 Sol (medium) तेज है: 10.33s vs 24.21s, pass rates 93.9% vs 86.4%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-23

तुलना किए गए मॉडल

रैंक
#14
कुल आउटपुट टोकन
29,115
प्रतिक्रिया समय (औसत)
10.33s
कुल लागत
$0.448
रैंक
#27
कुल आउटपुट टोकन
75,865
प्रतिक्रिया समय (औसत)
24.21s
कुल लागत
$0.664
अनुशंसित मॉडल GPT-6 Sol (medium)

It has the best score here (9.4), while responding about 2.3x faster than Qwen3.8 Max (0902) (low).

विस्तृत तुलना

मेट्रिक GPT-6 Sol GPT-6 Sol medium रिलीज़: 2026-09-23 Qwen3.8 Max (0902) Qwen3.8 Max (0902) low रिलीज़: 2026-09-07
स्कोर 9.4 9.1
रैंक #14 #27
विश्वसनीयता 10.0 10.0
संगति 9.6 9.3
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 93.9% 86.4%
अस्थिर टेस्ट 1 2
कुल रन 66 66
प्रति परिणाम लागत 2.240 3.684
कुल लागत $0.448 $0.664
इनपुट कीमत $2.000 / 1M $2.000 / 1M
आउटपुट कीमत $10.000 / 1M $6.000 / 1M
कुल इनपुट टोकन 78,376 103,954
आउटपुट टोकन 4,309 6,322
रीजनिंग टोकन 24,806 69,543
प्रतिक्रिया समय (औसत) 10.33s 24.21s
प्रतिक्रिया समय (अधिकतम) 82.74s 207.79s
प्रतिक्रिया समय (कुल) 227.17s 532.62s
पैरामीटर ~2T कुल (~150B सक्रिय) 2.4T कुल (~100B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#14 GPT-6 Sol

medium
लागत
$0.035
समय
36.9s
टोकन
3,493 tok

#27 Qwen3.8 Max (0902)

low
लागत
$0.014
समय
41.2s
टोकन
2,421 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-6 Sol 8.2 7.2 88.9% 1 11.78s 7,302 392 2,532
Qwen3.8 Max (0902) 10.0 10.0 100.0% 0 37.42s 8,127 485 17,404

त्वरित तुलना

तुलना जोड़ी बदलें