नेविगेशन
AI BENCHY
Advertise here

GPT-5.2 Chat vs Qwen3.6 Plus (medium)

GPT-5.2 Chat average score में आगे है: 7.9 vs 7.8. Qwen3.6 Plus (medium) की benchmark लागत कम है: $0.418 vs $0.594. GPT-5.2 Chat तेज है: 7.73s vs 45.52s, pass rates 69.7% vs 71.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-15

रैंक
#59
कुल आउटपुट टोकन
29,742
प्रतिक्रिया समय (औसत)
7.73s
कुल लागत
$0.594
रैंक
#63
कुल आउटपुट टोकन
197,632
प्रतिक्रिया समय (औसत)
45.52s
कुल लागत
$0.418
अनुशंसित मॉडल GPT-5.2 Chat

It has the best score here (7.9), while responding about 5.9x faster than Qwen3.6 Plus (medium).

विस्तृत तुलना

मेट्रिक GPT-5.2 Chat GPT-5.2 Chat none रिलीज़: 2025-12-11 Qwen3.6 Plus Qwen3.6 Plus medium रिलीज़: 2026-04-20
स्कोर 7.9 7.8
रैंक #59 #63
विश्वसनीयता 10.0 10.0
संगति 8.6 9.3
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 69.7% 71.2%
अस्थिर टेस्ट 4 2
कुल रन 66 66
प्रति परिणाम लागत 4.564 1.695
कुल लागत $0.594 $0.418
इनपुट कीमत $1.750 / 1M $0.325 / 1M
आउटपुट कीमत $14.000 / 1M $1.950 / 1M
कुल इनपुट टोकन 101,104 97,698
आउटपुट टोकन 29,742 6,417
रीजनिंग टोकन 0 191,215
प्रतिक्रिया समय (औसत) 7.73s 45.52s
प्रतिक्रिया समय (अधिकतम) 38.52s 291.55s
प्रतिक्रिया समय (कुल) 162.40s 955.94s
पैरामीटर ~400B कुल (~17B सक्रिय) ~397B कुल (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#59 GPT-5.2 Chat

none
लागत
$0.010
समय
15.3s
टोकन
797 tok

#63 Qwen3.6 Plus

medium
लागत
$0.024
समय
219.0s
टोकन
12,235 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.2 Chat 8.8 7.8 88.9% 1 9.82s 7,305 6,731 0
Qwen3.6 Plus 6.1 7.8 44.4% 1 153.12s 7,098 58 50,586

त्वरित तुलना

तुलना जोड़ी बदलें