OpenAI: GPT-5.3-Codex vs Qwen: Qwen3.7 Max

GPT-5.3-Codex (medium) mène au score moyen avec 8.9 vs 7.4. Qwen3.7 Max a le coût de benchmark le plus bas avec $0.197 vs $0.920. Qwen3.7 Max est plus rapide avec 4.52s vs 16.96s, avec des taux de réussite de 83.3% vs 68.2%.

Modèle recommandéQwen3.7 MaxIl offre le meilleur compromis global: score compétitif (7.4), coût inférieur à GPT-5.3-Codex (medium) et temps de réponse équilibré.

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-07-25

Métrique	GPT-5.3-Codex GPT-5.3-Codex medium Sortie: 2026-02-05	Qwen3.7 Max Qwen3.7 Max none Sortie: 2026-05-22

Métrique	GPT-5.3-Codex GPT-5.3-Codex medium Sortie: 2026-02-05	Qwen3.7 Max Qwen3.7 Max none Sortie: 2026-05-22
Score	8.9	7.4
Rang	#18	#67
Fiabilité	10.0	9.9
Cohérence	8.6	10.0
Tests corrects
Taux de réussite par tentative	83.3%	68.2%
Tests instables	4	0
Exécutions totales	66	66
Coût par résultat	5.748	1.582
Coût total	$0.920	$0.197
Prix d'entrée	$1.750 / 1M	$1.475 / 1M
Prix de sortie	$14.000 / 1M	$4.425 / 1M
Total des jetons d'entrée	81,268	95,983
Jetons de sortie	6,251	12,446
Jetons de raisonnement	49,274	0
Temps de réponse (moy.)	16.96s	4.52s
Temps de réponse (max)	100.93s	72.30s
Temps de réponse (total)	373.19s	99.52s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#18 GPT-5.3-Codex

medium

Coût: $0.049
Temps: 54.9s
Tokens: 3,580 tok

#67 Qwen3.7 Max

none

Coût: $0.046
Temps: 195.0s
Tokens: 12,171 tok

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Catégorie:

Astuces anti-IA	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
GPT-5.3-Codex	8.7	7.9	91.7%	1		4.16s	606	240	1,722
Qwen3.7 Max	6.5	10.0	50.0%	0		1.08s	696	242	0

Programmation	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
GPT-5.3-Codex	10.0	10.0	100.0%	0		19.50s	7,302	535	10,890
Qwen3.7 Max	5.5	10.0	33.3%	0		1.35s	7,911	582	0

Combiné	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
GPT-5.3-Codex	10.0	10.0	100.0%	0		26.04s	57,988	4,258	5,816
Qwen3.7 Max	6.5	10.0	50.0%	0		37.23s	68,425	10,623	0

Analyse et extraction des données	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
GPT-5.3-Codex	10.0	10.0	100.0%	0		3.07s	7,140	234	728
Qwen3.7 Max	10.0	10.0	100.0%	0		1.35s	7,794	243	0

Spécifique au domaine	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
GPT-5.3-Codex	5.9	7.2	55.6%	1		64.31s	813	64	25,308
Qwen3.7 Max	7.7	10.0	66.7%	0		975ms	789	15	0

Intelligence générale	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
GPT-5.3-Codex	4.6	10.0	0.0%	0		4.87s	477	187	331
Qwen3.7 Max	10.0	10.0	100.0%	0		1.04s	522	120	0

Suivi des instructions	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
GPT-5.3-Codex	10.0	10.0	100.0%	0		3.04s	660	93	693
Qwen3.7 Max	10.0	10.0	100.0%	0		943ms	711	72	0

Résolution d'énigmes	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
GPT-5.3-Codex	9.0	7.9	88.9%	1		5.05s	642	356	1,593
Qwen3.7 Max	10.0	10.0	100.0%	0		1.13s	714	314	0

Appel d'outils	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
GPT-5.3-Codex	10.0	10.0	100.0%	0		6.37s	5,445	254	492
Qwen3.7 Max	10.0	10.0	100.0%	0		3.92s	8,211	222	0

Culture générale	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
GPT-5.3-Codex	2.8	1.6	33.3%	1		14.43s	195	30	1,701
Qwen3.7 Max	3.0	10.0	0.0%	0		856ms	210	13	0

Comparaison rapide

Changer la paire de comparaison

GPT-5.3-CodexmediumvsGrok 4.5high Gemini 3.5 FlashlowvsGPT-5.3-Codexmedium LongCat 2.0mediumvsQwen3.7 Maxnone GPT-5.4 MinimediumvsQwen3.7 Maxnone GPT-5.6 TerralowvsQwen3.7 Maxnone Gemini 3 Flash PreviewlowvsQwen3.7 Maxnone KAT-Coder-Pro V2.5lowvsQwen3.7 Maxnone GPT-5.4 NanomediumvsQwen3.7 Maxnone Kimi K2.7 CodemediumvsQwen3.7 Maxnone Nemotron 3 UltramediumDisponible gratuitementvsQwen3.7 Maxnone Gemini 3.1 Flash Lite PreviewmediumvsQwen3.7 Maxnone GPT-5.6 LunamediumvsQwen3.7 Maxnone