नेविगेशन
Advertise here

GPT 5.3 Chat vs Qwen3.5-27B (medium)

average score लगभग बराबर है: 7.5 vs 7.5. GPT 5.3 Chat की benchmark लागत कम है: $0.533 vs $0.982. GPT 5.3 Chat तेज है: 6.56s vs 113.28s, pass rates 65.2% vs 75.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-28

तुलना किए गए मॉडल

रैंक
#122
कुल आउटपुट टोकन
28,179
प्रतिक्रिया समय (औसत)
6.56s
कुल लागत
$0.533
रैंक
#124
कुल आउटपुट टोकन
614,909
प्रतिक्रिया समय (औसत)
113.28s
कुल लागत
$0.982
अनुशंसित मॉडल GPT 5.3 Chat

It has the best score here (7.5), while costing about 1.8x less than Qwen3.5-27B (medium).

विस्तृत तुलना

मेट्रिक GPT 5.3 Chat GPT 5.3 Chat none रिलीज़: 2026-03-03 Qwen3.5-27B Qwen3.5-27B medium रिलीज़: 2026-02-24
स्कोर 7.5 7.5
रैंक #122 #124
विश्वसनीयता 10.0 10.0
संगति 8.6 7.8
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 65.2% 75.8%
अस्थिर टेस्ट 4 6
कुल रन 66 66
प्रति परिणाम लागत 4.097 8.217
कुल लागत $0.533 $0.982
इनपुट कीमत $1.750 / 1M $0.195 / 1M
आउटपुट कीमत $14.000 / 1M $1.560 / 1M
कुल इनपुट टोकन 78,846 111,644
आउटपुट टोकन 28,179 16,113
रीजनिंग टोकन 0 598,796
प्रतिक्रिया समय (औसत) 6.56s 113.28s
प्रतिक्रिया समय (अधिकतम) 18.33s 1026.43s
प्रतिक्रिया समय (कुल) 137.77s 2492.26s
पैरामीटर ~400B कुल (~17B सक्रिय) 27B
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#122 GPT 5.3 Chat

none
लागत
$0.008
समय
8.1s
टोकन
634 tok

#124 Qwen3.5-27B

medium
लागत
$0.008
समय
62.0s
टोकन
3,099 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT 5.3 Chat 5.6 4.7 55.6% 2 10.52s 7,302 6,632 0
Qwen3.5-27B 6.2 7.1 55.6% 1 160.69s 7,895 6,381 89,388

त्वरित तुलना

तुलना जोड़ी बदलें