नेविगेशन
Advertise here

GPT-5.2 Chat vs Qwen3.7 Plus (medium)

average score लगभग बराबर है: 7.9 vs 7.9. Qwen3.7 Plus (medium) की benchmark लागत कम है: $0.277 vs $0.594. GPT-5.2 Chat तेज है: 7.73s vs 53.51s, pass rates 69.7% vs 75.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-10

तुलना किए गए मॉडल

रैंक
#79
कुल आउटपुट टोकन
29,742
प्रतिक्रिया समय (औसत)
7.73s
कुल लागत
$0.594
रैंक
#82
कुल आउटपुट टोकन
187,337
प्रतिक्रिया समय (औसत)
53.51s
कुल लागत
$0.277
अनुशंसित मॉडल GPT-5.2 Chat

It has the best score here (7.9), while responding about 6.9x faster than Qwen3.7 Plus (medium).

विस्तृत तुलना

मेट्रिक GPT-5.2 Chat GPT-5.2 Chat none रिलीज़: 2025-12-11 Qwen3.7 Plus Qwen3.7 Plus medium रिलीज़: 2026-06-03
स्कोर 7.9 7.9
रैंक #79 #82
विश्वसनीयता 10.0 10.0
संगति 8.6 8.9
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 69.7% 75.8%
अस्थिर टेस्ट 4 3
कुल रन 66 66
प्रति परिणाम लागत 4.564 2.134
कुल लागत $0.594 $0.277
इनपुट कीमत $1.750 / 1M $0.320 / 1M
आउटपुट कीमत $14.000 / 1M $1.280 / 1M
कुल इनपुट टोकन 101,104 115,242
आउटपुट टोकन 29,742 6,163
रीजनिंग टोकन 0 181,174
प्रतिक्रिया समय (औसत) 7.73s 53.51s
प्रतिक्रिया समय (अधिकतम) 38.52s 315.30s
प्रतिक्रिया समय (कुल) 162.40s 1177.25s
पैरामीटर ~400B कुल (~17B सक्रिय) ~397B कुल (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#79 GPT-5.2 Chat

none
लागत
$0.010
समय
15.3s
टोकन
797 tok

#82 Qwen3.7 Plus

medium
लागत
$0.018
समय
193.2s
टोकन
10,821 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.2 Chat 8.8 7.8 88.9% 1 9.82s 7,305 6,731 0
Qwen3.7 Plus 6.1 6.6 55.6% 1 108.60s 6,472 414 43,576

त्वरित तुलना

तुलना जोड़ी बदलें