नेविगेशन
Advertise here

GPT-6.1 Sol (high) vs Qwen3.8 Max (0902) (low)

GPT-6.1 Sol (high) average score में आगे है: 9.6 vs 9.1. GPT-6.1 Sol (high) की benchmark लागत कम है: $0.542 vs $0.664. GPT-6.1 Sol (high) तेज है: 13.68s vs 24.21s, pass rates 93.9% vs 86.4%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-29

तुलना किए गए मॉडल

रैंक
#12
कुल आउटपुट टोकन
38,258
प्रतिक्रिया समय (औसत)
13.68s
कुल लागत
$0.542
रैंक
#32
कुल आउटपुट टोकन
75,865
प्रतिक्रिया समय (औसत)
24.21s
कुल लागत
$0.664
अनुशंसित मॉडल GPT-6.1 Sol (high)

It has the best score here (9.6), while responding about 1.8x faster than Qwen3.8 Max (0902) (low).

विस्तृत तुलना

मेट्रिक GPT-6.1 Sol GPT-6.1 Sol high रिलीज़: 2026-09-29 Qwen3.8 Max (0902) Qwen3.8 Max (0902) low रिलीज़: 2026-09-07
स्कोर 9.6 9.1
रैंक #12 #32
विश्वसनीयता 10.0 10.0
संगति 9.6 9.3
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 93.9% 86.4%
अस्थिर टेस्ट 1 2
कुल रन 66 66
प्रति परिणाम लागत 2.708 3.684
कुल लागत $0.542 $0.664
इनपुट कीमत $2.000 / 1M $2.000 / 1M
आउटपुट कीमत $10.000 / 1M $6.000 / 1M
कुल इनपुट टोकन 79,492 103,954
आउटपुट टोकन 4,954 6,322
रीजनिंग टोकन 33,304 69,543
प्रतिक्रिया समय (औसत) 13.68s 24.21s
प्रतिक्रिया समय (अधिकतम) 139.76s 207.79s
प्रतिक्रिया समय (कुल) 301.03s 532.62s
पैरामीटर ~2T कुल (~150B सक्रिय) 2.4T कुल (~100B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#12 GPT-6.1 Sol

high
लागत
$0.079
समय
149.5s
टोकन
7,920 tok

#32 Qwen3.8 Max (0902)

low
लागत
$0.014
समय
41.2s
टोकन
2,421 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-6.1 Sol 10.0 10.0 100.0% 0 5.18s 7,302 390 2,215
Qwen3.8 Max (0902) 10.0 10.0 100.0% 0 37.42s 8,127 485 17,404

त्वरित तुलना

तुलना जोड़ी बदलें