नेविगेशन
Advertise here

GPT 5.3 Chat vs Qwen3.5 Plus 2026-02-15 (medium)

average score लगभग बराबर है: 7.5 vs 7.5. Qwen3.5 Plus 2026-02-15 (medium) की benchmark लागत कम है: $0.459 vs $0.533. GPT 5.3 Chat तेज है: 6.56s vs 91.76s, pass rates 65.2% vs 72.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-28

तुलना किए गए मॉडल

रैंक
#122
कुल आउटपुट टोकन
28,179
प्रतिक्रिया समय (औसत)
6.56s
कुल लागत
$0.533
रैंक
#123
कुल आउटपुट टोकन
274,709
प्रतिक्रिया समय (औसत)
91.76s
कुल लागत
$0.459
अनुशंसित मॉडल GPT 5.3 Chat

It has the best score here (7.5), while responding about 14.0x faster than Qwen3.5 Plus 2026-02-15 (medium).

विस्तृत तुलना

मेट्रिक GPT 5.3 Chat GPT 5.3 Chat none रिलीज़: 2026-03-03 Qwen3.5 Plus 2026-02-15 Qwen3.5 Plus 2026-02-15 medium रिलीज़: 2026-02-15
स्कोर 7.5 7.5
रैंक #122 #123
विश्वसनीयता 10.0 10.0
संगति 8.6 8.1
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 65.2% 72.7%
अस्थिर टेस्ट 4 5
कुल रन 66 66
प्रति परिणाम लागत 4.097 3.483
कुल लागत $0.533 $0.459
इनपुट कीमत $1.750 / 1M $0.260 / 1M
आउटपुट कीमत $14.000 / 1M $1.560 / 1M
कुल इनपुट टोकन 78,846 113,569
आउटपुट टोकन 28,179 9,823
रीजनिंग टोकन 0 264,886
प्रतिक्रिया समय (औसत) 6.56s 91.76s
प्रतिक्रिया समय (अधिकतम) 18.33s 304.85s
प्रतिक्रिया समय (कुल) 137.77s 1376.42s
पैरामीटर ~400B कुल (~17B सक्रिय) ~397B कुल (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#122 GPT 5.3 Chat

none
लागत
$0.008
समय
8.1s
टोकन
634 tok

#123 Qwen3.5 Plus 2026-02-15

medium
लागत
$0.011
समय
125.5s
टोकन
7,040 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT 5.3 Chat 5.6 4.7 55.6% 2 10.52s 7,302 6,632 0
Qwen3.5 Plus 2026-02-15 6.6 7.1 44.4% 1 180.70s 6,950 420 80,595

त्वरित तुलना

तुलना जोड़ी बदलें