नेविगेशन
AI BENCHY
Advertise here

GPT-5.2 Chat vs Qwen3.7 Plus (medium)

GPT-5.2 Chat average score में आगे है: 8.0 vs 7.9. Qwen3.7 Plus (medium) की benchmark लागत कम है: $0.267 vs $0.604. GPT-5.2 Chat तेज है: 7.65s vs 51.51s, pass rates 74.2% vs 75.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-28

रैंक
#37
कुल आउटपुट टोकन
30,424
प्रतिक्रिया समय (औसत)
7.65s
कुल लागत
$0.604
रैंक
#43
कुल आउटपुट टोकन
179,429
प्रतिक्रिया समय (औसत)
51.51s
कुल लागत
$0.267
अनुशंसित मॉडल GPT-5.2 Chat

It has the best score here (8.0), while responding about 6.7x faster than Qwen3.7 Plus (medium).

विस्तृत तुलना

मेट्रिक GPT-5.2 Chat GPT-5.2 Chat none रिलीज़: 2025-12-11 Qwen3.7 Plus Qwen3.7 Plus medium रिलीज़: 2026-06-03
स्कोर 8.0 7.9
रैंक #37 #43
विश्वसनीयता 10.0 10.0
संगति 8.6 8.9
सही परीक्षण
प्रति प्रयास पास दर 74.2% 75.8%
अस्थिर टेस्ट 4 3
कुल रन 66 66
प्रति परिणाम लागत 4.308 2.072
कुल लागत $0.604 $0.267
इनपुट कीमत $1.750 / 1M $0.320 / 1M
आउटपुट कीमत $14.000 / 1M $1.280 / 1M
कुल इनपुट टोकन 101,248 115,233
आउटपुट टोकन 30,424 6,162
रीजनिंग टोकन 0 173,267
प्रतिक्रिया समय (औसत) 7.65s 51.51s
प्रतिक्रिया समय (अधिकतम) 38.52s 315.30s
प्रतिक्रिया समय (कुल) 168.39s 1133.15s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#37 GPT-5.2 Chat

none
लागत
$0.010
समय
15.3s
टोकन
797 tok

#43 Qwen3.7 Plus

medium
लागत
$0.018
समय
193.2s
टोकन
10,821 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.2 Chat 8.8 7.8 88.9% 1 9.82s 7,305 6,731 0
Qwen3.7 Plus 6.1 6.6 55.6% 1 108.60s 6,472 414 43,576

त्वरित तुलना

तुलना जोड़ी बदलें