नेविगेशन
AI BENCHY
Advertise here

GPT-5.3 Chat vs Qwen3.6 Max Preview (medium)

Qwen3.6 Max Preview (medium) average score में आगे है: 8.4 vs 7.5. GPT-5.3 Chat की benchmark लागत कम है: $0.571 vs $1.143. GPT-5.3 Chat तेज है: 6.88s vs 67.53s, pass rates 68.2% vs 80.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

रैंक
#62
कुल आउटपुट टोकन
30,854
प्रतिक्रिया समय (औसत)
6.88s
कुल लागत
$0.571
रैंक
#25
कुल आउटपुट टोकन
169,940
प्रतिक्रिया समय (औसत)
67.53s
कुल लागत
$1.143
अनुशंसित मॉडल GPT-5.3 Chat

It offers the best overall trade-off: a competitive score (7.5), lower cost than Qwen3.6 Max Preview (medium), and balanced response time.

विस्तृत तुलना

मेट्रिक GPT-5.3 Chat GPT-5.3 Chat none रिलीज़: 2026-03-03 Qwen3.6 Max Preview Qwen3.6 Max Preview medium रिलीज़: 2026-04-20
स्कोर 7.5 8.4
रैंक #62 #25
विश्वसनीयता 10.0 9.9
संगति 8.2 8.9
सही परीक्षण
प्रति प्रयास पास दर 68.2% 80.3%
अस्थिर टेस्ट 5 3
कुल रन 66 66
प्रति परिणाम लागत 4.387 8.173
कुल लागत $0.571 $1.143
इनपुट कीमत $1.750 / 1M $1.040 / 1M
आउटपुट कीमत $14.000 / 1M $6.240 / 1M
कुल इनपुट टोकन 78,990 79,240
आउटपुट टोकन 30,854 5,098
रीजनिंग टोकन 0 164,842
प्रतिक्रिया समय (औसत) 6.88s 67.53s
प्रतिक्रिया समय (अधिकतम) 18.33s 238.07s
प्रतिक्रिया समय (कुल) 151.31s 1485.64s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#62 GPT-5.3 Chat

none
लागत
$0.008
समय
8.1s
टोकन
634 tok

#25 Qwen3.6 Max Preview

medium
लागत
$0.024
समय
76.5s
टोकन
3,861 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.3 Chat 5.6 4.7 55.6% 2 10.52s 7,302 6,632 0
Qwen3.6 Max Preview 8.8 7.8 88.9% 1 146.48s 7,895 427 52,957

त्वरित तुलना

तुलना जोड़ी बदलें