नेविगेशन
AI BENCHY
Advertise here

GPT-5.3 Chat vs Qwen3.8 2.4T A95B (high)

average score लगभग बराबर है: 7.5 vs 7.5. GPT-5.3 Chat की benchmark लागत कम है: $0.571 vs $2.755. GPT-5.3 Chat तेज है: 6.88s vs 134.41s, pass rates 68.2% vs 77.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-12

रैंक
#81
कुल आउटपुट टोकन
30,854
प्रतिक्रिया समय (औसत)
6.88s
कुल लागत
$0.571
रैंक
#85
कुल आउटपुट टोकन
512,351
प्रतिक्रिया समय (औसत)
134.41s
कुल लागत
$2.755
अनुशंसित मॉडल GPT-5.3 Chat

It has the best score here (7.5), while costing about 4.8x less than Qwen3.8 2.4T A95B (high).

विस्तृत तुलना

मेट्रिक GPT-5.3 Chat GPT-5.3 Chat none रिलीज़: 2026-03-03 Qwen3.8 2.4T A95B Qwen3.8 2.4T A95B high रिलीज़: 2026-08-12
स्कोर 7.5 7.5
रैंक #81 #85
विश्वसनीयता 10.0 8.8
संगति 8.2 8.4
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 68.2% 77.3%
अस्थिर टेस्ट 5 4
कुल रन 66 66
प्रति परिणाम लागत 4.387 18.365
कुल लागत $0.571 $2.755
इनपुट कीमत $1.750 / 1M $2.000 / 1M
आउटपुट कीमत $14.000 / 1M $6.000 / 1M
कुल इनपुट टोकन 78,990 109,036
आउटपुट टोकन 30,854 103,736
रीजनिंग टोकन 0 408,615
प्रतिक्रिया समय (औसत) 6.88s 134.41s
प्रतिक्रिया समय (अधिकतम) 18.33s 532.28s
प्रतिक्रिया समय (कुल) 151.31s 2956.97s
पैरामीटर ~400B कुल (~17B सक्रिय) 2.4T कुल (95B सक्रिय)
उपलब्धता बंद स्रोत वेट उपलब्ध

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#81 GPT-5.3 Chat

none
लागत
$0.008
समय
8.1s
टोकन
634 tok

#85 Qwen3.8 2.4T A95B

high
अमान्य SVG
लागत
$0.000
समय
600.0s
टोकन
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.3 Chat 5.6 4.7 55.6% 2 10.52s 7,302 6,632 0
Qwen3.8 2.4T A95B 5.9 6.3 55.6% 1 160.52s 6,399 3,310 48,078

त्वरित तुलना

तुलना जोड़ी बदलें