नेविगेशन
AI BENCHY
Advertise here

OpenAI: GPT-5.3 Chat vs Qwen: Qwen3.7 Max

GPT-5.3 Chat average score में आगे है: 7.5 vs 7.4. Qwen3.7 Max की benchmark लागत कम है: $0.197 vs $0.571. Qwen3.7 Max तेज है: 4.52s vs 6.88s, pass rates 68.2% vs 68.2%.

अनुशंसित मॉडलQwen3.7 MaxIts score stays close to the best score here (7.4 vs 7.5), while costing about 2.9x less than GPT-5.3 Chat.
रैंक
#62
प्रति प्रयास पास दर
68.2%
कुल आउटपुट टोकन
30,854
प्रतिक्रिया समय (औसत)
6.88s
कुल लागत
$0.571
रैंक
#67
प्रति प्रयास पास दर
68.2%
कुल आउटपुट टोकन
12,446
प्रतिक्रिया समय (औसत)
4.52s
कुल लागत
$0.197

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

मेट्रिक GPT-5.3 Chat GPT-5.3 Chat none रिलीज़: 2026-03-03 Qwen3.7 Max Qwen3.7 Max none रिलीज़: 2026-05-22
स्कोर 7.5 7.4
रैंक #62 #67
विश्वसनीयता 10.0 9.9
संगति 8.2 10.0
सही परीक्षण
प्रति प्रयास पास दर 68.2% 68.2%
अस्थिर टेस्ट 5 0
कुल रन 66 66
प्रति परिणाम लागत 4.387 1.582
कुल लागत $0.571 $0.197
इनपुट कीमत $1.750 / 1M $1.475 / 1M
आउटपुट कीमत $14.000 / 1M $4.425 / 1M
कुल इनपुट टोकन 78,990 95,983
आउटपुट टोकन 30,854 12,446
रीजनिंग टोकन 0 0
प्रतिक्रिया समय (औसत) 6.88s 4.52s
प्रतिक्रिया समय (अधिकतम) 18.33s 72.30s
प्रतिक्रिया समय (कुल) 151.31s 99.52s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#62 GPT-5.3 Chat

none
लागत
$0.008
समय
8.1s
टोकन
634 tok

#67 Qwen3.7 Max

none
लागत
$0.046
समय
195.0s
टोकन
12,171 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.3 Chat 5.6 4.7 55.6% 2 10.52s 7,302 6,632 0
Qwen3.7 Max 5.5 10.0 33.3% 0 1.35s 7,911 582 0

त्वरित तुलना

तुलना जोड़ी बदलें