AI BENCHY Compare

OpenAI: GPT-5.2 Chat vs Qwen: Qwen3.6 Plus

Rezumat

Comparație benchmark GPT-5.2 Chat vs Qwen3.6 Plus: GPT-5.2 Chat conduce la scorul mediu cu 8.5 vs 7.8. Qwen3.6 Plus are costul de benchmark mai mic, $0.294 vs $0.393. GPT-5.2 Chat este mai rapid cu 7.13s vs 30.70s, cu rate de reușită de 74.6% vs 69.8%.

Model recomandat: GPT-5.2 Chat - Are cel mai bun scor aici (8.5) și răspunde de aproximativ 4.3x mai rapid decât Qwen3.6 Plus.

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-07-02

Metrică	GPT-5.2 Chat GPT-5.2 Chat none Lansare: 2025-12-11	Qwen3.6 Plus Qwen3.6 Plus medium Lansare: 2026-04-20

Metrică	GPT-5.2 Chat GPT-5.2 Chat none Lansare: 2025-12-11	Qwen3.6 Plus Qwen3.6 Plus medium Lansare: 2026-04-20
Scor	8.5	7.8
Rang	#19	#31
Fiabilitate	10.0	10.0
Consistență	8.9	9.3
Teste corecte
Rată de trecere pe încercare	74.6%	69.8%
Teste instabile	3	2
Rulări totale	63	63
Cost per rezultat	2.803	0.831
Cost total	$0.393	$0.294
Preț de intrare	$1.750 / 1M	$0.325 / 1M
Preț de ieșire	$14.000 / 1M	$1.950 / 1M
Total tokenuri de intrare	34,212	41,565
Tokenuri de ieșire	23,744	1,853
Tokenuri de raționament	0	141,973
Timp de răspuns (mediu)	7.13s	30.70s
Timp de răspuns (maxim)	38.52s	201.68s
Timp de răspuns (total)	149.69s	613.99s

Prezentare generare

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#19 GPT-5.2 Chat

none

Cost: $0.010
Timp: 15.3s
Tokenuri: 797 tok

#31 Qwen3.6 Plus

medium

Cost: $0.024
Timp: 219.0s
Tokenuri: 12,235 tok

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
GPT-5.2 Chat	8.7	7.9	91.7%	1		3.40s	606	1,807	0
Qwen3.6 Plus	10.0	10.0	100.0%	0		9.90s	672	207	7,557

Programare	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
GPT-5.2 Chat	8.8	7.8	88.9%	1		9.82s	7,305	6,731	0
Qwen3.6 Plus	6.1	7.8	44.4%	1		153.12s	7,098	58	50,586

Combinat	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
GPT-5.2 Chat	10.0	10.0	100.0%	0		9.12s	11,019	1,243	0
Qwen3.6 Plus	10.0	10.0	100.0%	0		34.95s	14,934	452	13,073

Parsare și extragere de date	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
GPT-5.2 Chat	10.0	10.0	100.0%	0		3.05s	7,140	980	0
Qwen3.6 Plus	10.0	10.0	100.0%	0		14.95s	7,782	270	10,706

Specific domeniului	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
GPT-5.2 Chat	5.3	10.0	33.3%	0		17.78s	723	7,810	0
Qwen3.6 Plus	2.9	7.2	11.1%	1		29.59s	771	56	33,464

Inteligență generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
GPT-5.2 Chat	4.4	3.0	33.3%	1		3.20s	477	335	0
Qwen3.6 Plus	5.1	10.0	0.0%	0		27.05s	516	111	5,232

Respectarea instrucțiunilor	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
GPT-5.2 Chat	9.8	10.0	100.0%	0		5.51s	660	1,441	0
Qwen3.6 Plus	10.0	10.0	100.0%	0		7.54s	699	102	5,552

Rezolvare de puzzle-uri	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
GPT-5.2 Chat	7.7	10.0	66.7%	0		4.10s	642	1,603	0
Qwen3.6 Plus	10.0	10.0	100.0%	0		6.34s	696	309	6,712

Apelare instrumente	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
GPT-5.2 Chat	10.0	10.0	100.0%	0		4.68s	5,445	555	0
Qwen3.6 Plus	10.0	10.0	100.0%	0		5.87s	8,193	267	1,330

Cultură generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
GPT-5.2 Chat	3.0	10.0	0.0%	0		6.89s	195	1,239	0
Qwen3.6 Plus	3.0	10.0	0.0%	0		47.51s	204	21	7,761

Comparație rapidă

Schimbă perechea de comparație

Seed-2.0-LitemediumvsGPT-5.2 Chatnone GPT-5.2 ChatnonevsStep 3.7 Flashmedium GPT-5.2 ChatnonevsGLM 5medium Claude Opus 4.8lowvsQwen3.6 Plusmedium Qwen3.6 PlusmediumvsStep 3.7 Flashlow GPT-5.2 ChatnonevsGLM 5.2medium DeepSeek V4 FlashhighvsGPT-5.2 Chatnone Claude Opus 4.7mediumvsGPT-5.2 Chatnone DeepSeek V4 ProhighvsQwen3.6 Plusmedium Gemini 2.5 FlashmediumvsGPT-5.2 Chatnone GPT-5.2 ChatnonevsQwen3.7 Plusmedium GPT-5.3 ChatnonevsQwen3.6 Plusmedium