AI BENCHY Compare

OpenAI: GPT-5.3 Chat vs Qwen: Qwen3.6 35B A3B

Résumé

Comparaison benchmark GPT-5.3 Chat vs Qwen3.6 35B A3B : GPT-5.3 Chat mène au score moyen avec 7.5 vs 6.7. Qwen3.6 35B A3B a le coût de benchmark le plus bas avec $0.146 vs $0.433. GPT-5.3 Chat est plus rapide avec 6.34s vs 18.08s, avec des taux de réussite de 66.7% vs 63.5%.

Modèle recommandé: GPT-5.3 Chat - Il obtient le meilleur score ici (7.5) et répond environ 2.9x plus vite que Qwen3.6 35B A3B.

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-06-18

Métrique	GPT-5.3 Chat GPT-5.3 Chat none Sortie: 2026-03-03	Qwen3.6 35B A3B Qwen3.6 35B A3B medium Sortie: 2026-04-20

Métrique	GPT-5.3 Chat GPT-5.3 Chat none Sortie: 2026-03-03	Qwen3.6 35B A3B Qwen3.6 35B A3B medium Sortie: 2026-04-20
Score	7.5	6.7
Rang	#45	#75
Fiabilité	10.0	10.0
Cohérence	8.1	9.6
Tests corrects
Taux de réussite par tentative	66.7%	63.5%
Tests instables	5	1
Exécutions totales	63	63
Coût par résultat	3.605	1.094
Coût total	$0.433	$0.146
Prix d'entrée	$1.750 / 1M	$0.140 / 1M
Prix de sortie	$14.000 / 1M	$1.000 / 1M
Total des jetons d'entrée	34,209	16,385
Jetons de sortie	26,617	19,632
Jetons de raisonnement	0	130,219
Temps de réponse (moy.)	6.34s	18.08s
Temps de réponse (max)	18.33s	86.11s
Temps de réponse (total)	133.13s	343.61s

Génération showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#45 GPT-5.3 Chat

none

Coût: $0.008
Temps: 8.1s
Tokens: 634 tok

#75 Qwen3.6 35B A3B

medium

SVG invalide

Coût: $0.000
Temps: 300.0s
Tokens: 0 tok

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Astuces anti-IA	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
GPT-5.3 Chat	6.7	8.1	58.3%	1		3.86s	606	3,167	0
Qwen3.6 35B A3B	10.0	10.0	100.0%	0		6.02s	672	1,154	12,385

Programmation	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
GPT-5.3 Chat	5.6	4.7	55.6%	2		10.52s	7,302	6,632	0
Qwen3.6 35B A3B	7.7	10.0	66.7%	0		50.55s	5,051	7,929	37,223

Combiné	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
GPT-5.3 Chat	10.0	10.0	100.0%	0		11.96s	11,019	2,614	0
Qwen3.6 35B A3B	3.0	10.0	0.0%	0		0ms	0	0	0

Analyse et extraction des données	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
GPT-5.3 Chat	10.0	10.0	100.0%	0		2.21s	7,140	942	0
Qwen3.6 35B A3B	10.0	10.0	100.0%	0		12.99s	7,776	2,591	9,968

Spécifique au domaine	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
GPT-5.3 Chat	3.5	4.4	33.3%	2		13.01s	723	8,264	0
Qwen3.6 35B A3B	5.3	7.2	44.4%	1		22.50s	771	6,193	39,116

Intelligence générale	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
GPT-5.3 Chat	4.6	10.0	0.0%	0		1.99s	477	319	0
Qwen3.6 35B A3B	4.4	9.9	0.0%	0		8.66s	516	129	4,569

Suivi des instructions	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
GPT-5.3 Chat	9.8	10.0	100.0%	0		3.51s	660	1,491	0
Qwen3.6 35B A3B	10.0	10.0	100.0%	0		7.50s	699	219	7,404

Résolution d'énigmes	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
GPT-5.3 Chat	10.0	10.0	100.0%	0		2.99s	642	1,758	0
Qwen3.6 35B A3B	8.0	10.0	66.7%	0		5.95s	696	655	9,228

Appel d'outils	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
GPT-5.3 Chat	10.0	10.0	100.0%	0		8.36s	5,445	861	0
Qwen3.6 35B A3B	3.0	10.0	0.0%	0		0ms	0	0	0

Culture générale	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
GPT-5.3 Chat	3.0	10.0	0.0%	0		4.38s	195	569	0
Qwen3.6 35B A3B	3.0	10.0	0.0%	0		32.90s	204	762	10,326

Comparaison rapide

Changer la paire de comparaison

Mercury 2mediumvsGPT-5.3 Chatnone Kimi K2.5mediumvsGPT-5.3 Chatnone GPT-5.3 ChatnonevsQwen3.6 Flashmedium DeepSeek V3.2mediumvsGPT-5.3 Chatnone GPT-5.3 ChatnonevsGrok Build 0.1medium Gemini 3.5 FlashminimalvsQwen3.6 35B A3Bmedium DeepSeek V4 ProhighvsGPT-5.3 Chatnone Seed-2.0-MinimediumvsGPT-5.3 Chatnone GPT-5.3 ChatnonevsMiMo-V2.5-Promedium MiniMax M3mediumvsGPT-5.3 Chatnone Gemini 3 Flash PreviewlowvsGPT-5.3 Chatnone GPT-5.3 ChatnonevsGrok 4.20medium