AI BENCHY तुलना

OpenAI: GPT-5.2 Chat vs Qwen: Qwen3.5 Plus 2026-04-20

सारांश

GPT-5.2 Chat vs Qwen3.5 Plus 2026-04-20 benchmark तुलना: GPT-5.2 Chat average score में आगे है: 7.9 vs 7.6. Qwen3.5 Plus 2026-04-20 की benchmark लागत कम है: $0.317 vs $0.393. GPT-5.2 Chat तेज है: 7.13s vs 46.36s, pass rates 74.6% vs 66.7%.

अनुशंसित मॉडल: GPT-5.2 Chat - It has the best score here (7.9), while responding about 6.5x faster than Qwen3.5 Plus 2026-04-20.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-06-10

मेट्रिक	GPT-5.2 Chat GPT-5.2 Chat none रिलीज़: 2025-12-11	Qwen3.5 Plus 2026-04-20 Qwen3.5 Plus 2026-04-20 medium रिलीज़: 2026-04-20

मेट्रिक	GPT-5.2 Chat GPT-5.2 Chat none रिलीज़: 2025-12-11	Qwen3.5 Plus 2026-04-20 Qwen3.5 Plus 2026-04-20 medium रिलीज़: 2026-04-20
स्कोर	7.9	7.6
रैंक	#25	#37
विश्वसनीयता	10.0	10.0
संगति	8.9	9.0
सही परीक्षण
प्रति प्रयास पास दर	74.6%	66.7%
अस्थिर टेस्ट	3	2
कुल रन	63	63
प्रति परिणाम लागत	2.803	3.023
कुल लागत	$0.393	$0.317
इनपुट कीमत	$1.750 / 1M	$0.300 / 1M
आउटपुट कीमत	$14.000 / 1M	$1.800 / 1M
कुल इनपुट टोकन	34,212	42,097
आउटपुट टोकन	23,744	2,280
रीजनिंग टोकन	0	166,613
प्रतिक्रिया समय (औसत)	7.13s	46.36s
प्रतिक्रिया समय (अधिकतम)	38.52s	189.38s
प्रतिक्रिया समय (कुल)	149.69s	973.57s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#25 GPT-5.2 Chat

none

Cost: $0.010
Time: 15.3s
Tokens: 797 tok

#37 Qwen3.5 Plus 2026-04-20

medium

Cost: $0.008
Time: 76.7s
Tokens: 4,355 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
GPT-5.2 Chat	8.7	7.9	91.7%	1		3.40s	606	1,807	0
Qwen3.5 Plus 2026-04-20	10.0	10.0	100.0%	0		10.84s	672	215	7,748

कोडिंग	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
GPT-5.2 Chat	8.8	7.8	88.9%	1		9.82s	7,305	6,731	0
Qwen3.5 Plus 2026-04-20	6.2	8.7	33.3%	0		125.25s	7,630	308	58,682

संयुक्त	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
GPT-5.2 Chat	10.0	10.0	100.0%	0		9.12s	11,019	1,243	0
Qwen3.5 Plus 2026-04-20	10.0	10.0	100.0%	0		92.41s	14,934	483	17,490

डेटा पार्सिंग और निष्कर्षण	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
GPT-5.2 Chat	10.0	10.0	100.0%	0		3.05s	7,140	980	0
Qwen3.5 Plus 2026-04-20	10.0	10.0	100.0%	0		38.32s	7,782	270	14,668

डोमेन-विशिष्ट	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
GPT-5.2 Chat	5.3	10.0	33.3%	0		17.78s	723	7,810	0
Qwen3.5 Plus 2026-04-20	2.9	7.2	11.1%	1		53.10s	771	63	28,414

Samanya Buddhimatta	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
GPT-5.2 Chat	4.4	3.0	33.3%	1		3.20s	477	335	0
Qwen3.5 Plus 2026-04-20	4.9	9.6	0.0%	0		25.30s	516	125	4,792

निर्देश पालन	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
GPT-5.2 Chat	9.8	10.0	100.0%	0		5.51s	660	1,441	0
Qwen3.5 Plus 2026-04-20	10.0	10.0	100.0%	0		20.25s	699	103	7,689

पहेली समाधान	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
GPT-5.2 Chat	7.7	10.0	66.7%	0		4.10s	642	1,603	0
Qwen3.5 Plus 2026-04-20	8.2	7.2	88.9%	1		17.67s	696	338	9,800

टूल कॉलिंग	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
GPT-5.2 Chat	10.0	10.0	100.0%	0		4.68s	5,445	555	0
Qwen3.5 Plus 2026-04-20	10.0	10.0	100.0%	0		14.72s	8,193	348	2,164

सामान्य ज्ञान	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
GPT-5.2 Chat	3.0	10.0	0.0%	0		6.89s	195	1,239	0
Qwen3.5 Plus 2026-04-20	3.0	10.0	0.0%	0		92.57s	204	27	15,166

त्वरित तुलना

तुलना जोड़ी बदलें

GPT-5.2 ChatnonevsQwen3.5 Plus 2026-02-15medium GPT-5.2 ChatnonevsGLM 5 Turbomedium GPT-5.2 ChatnonevsStep 3.7 Flashmedium GPT-5.2 ChatnonevsQwen3.6 Plusmedium Gemini 3.5 FlashminimalvsQwen3.5 Plus 2026-04-20medium Gemma 4 31Bmediumनिःशुल्क उपलब्धvsGPT-5.2 Chatnone Gemini 2.5 FlashmediumvsGPT-5.2 Chatnone DeepSeek V4 FlashhighvsQwen3.5 Plus 2026-04-20medium GPT-5.2 ChatnonevsQwen3.5-122B-A10Bmedium GPT-5.2 ChatnonevsQwen3.5-27Bmedium DeepSeek V4 FlashhighvsGPT-5.2 Chatnone Gemini 3 Flash PreviewnonevsQwen3.5 Plus 2026-04-20medium