AI BENCHY Compare

OpenAI: GPT-5.5 vs Qwen: Qwen3.6 Max Preview

Résumé

Comparaison benchmark GPT-5.5 vs Qwen3.6 Max Preview : GPT-5.5 mène au score moyen avec 9.0 vs 6.0. Qwen3.6 Max Preview a le coût de benchmark le plus bas avec $0.075 vs $3.679. Qwen3.6 Max Preview est plus rapide avec 3.30s vs 37.98s, avec des taux de réussite de 87.3% vs 58.7%.

Modèle recommandé: Qwen3.6 Max Preview - Il offre le meilleur compromis global: score compétitif (6.0), coût inférieur à GPT-5.5 et temps de réponse équilibré.

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-06-18

Métrique	GPT-5.5 GPT-5.5 medium Sortie: 2026-04-24	Qwen3.6 Max Preview Qwen3.6 Max Preview none Sortie: 2026-04-20

Métrique	GPT-5.5 GPT-5.5 medium Sortie: 2026-04-24	Qwen3.6 Max Preview Qwen3.6 Max Preview none Sortie: 2026-04-20
Score	9.0	6.0
Rang	#9	#100
Fiabilité	10.0	10.0
Cohérence	8.9	9.2
Tests corrects
Taux de réussite par tentative	87.3%	58.7%
Tests instables	3	2
Exécutions totales	63	63
Coût par résultat	21.638	0.824
Coût total	$3.679	$0.075
Prix d'entrée	$5.000 / 1M	$1.040 / 1M
Prix de sortie	$30.000 / 1M	$6.240 / 1M
Total des jetons d'entrée	34,212	42,509
Jetons de sortie	1,985	4,779
Jetons de raisonnement	114,925	0
Temps de réponse (moy.)	37.98s	3.30s
Temps de réponse (max)	332.10s	20.51s
Temps de réponse (total)	797.60s	69.40s

Génération showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#9 GPT-5.5

medium

Coût: $0.112
Temps: 71.9s
Tokens: 3,807 tok

#100 Qwen3.6 Max Preview

none

Coût: $0.025
Temps: 83.9s
Tokens: 4,066 tok

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Astuces anti-IA	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
GPT-5.5	10.0	10.0	100.0%	0		4.66s	606	250	1,335
Qwen3.6 Max Preview	5.2	7.9	41.7%	1		2.63s	696	513	0

Programmation	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
GPT-5.5	8.8	7.8	88.9%	1		59.77s	7,305	362	24,959
Qwen3.6 Max Preview	3.8	7.3	22.2%	1		3.12s	7,913	456	0

Combiné	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
GPT-5.5	10.0	10.0	100.0%	0		19.29s	11,019	312	2,841
Qwen3.6 Max Preview	3.0	10.0	0.0%	0		20.51s	14,949	2,842	0

Analyse et extraction des données	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
GPT-5.5	10.0	10.0	100.0%	0		4.18s	7,140	234	593
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		2.87s	7,794	243	0

Spécifique au domaine	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
GPT-5.5	5.3	7.2	44.4%	1		164.14s	723	67	79,625
Qwen3.6 Max Preview	7.7	10.0	66.7%	0		1.22s	789	18	0

Intelligence générale	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
GPT-5.5	10.0	10.0	100.0%	0		4.16s	477	138	223
Qwen3.6 Max Preview	4.3	10.0	0.0%	0		1.62s	522	76	0

Suivi des instructions	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
GPT-5.5	10.0	10.0	100.0%	0		3.36s	660	93	538
Qwen3.6 Max Preview	9.8	10.0	100.0%	0		1.40s	711	69	0

Résolution d'énigmes	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
GPT-5.5	10.0	10.0	100.0%	0		6.76s	642	241	2,225
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		2.65s	714	321	0

Appel d'outils	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
GPT-5.5	10.0	10.0	100.0%	0		10.57s	5,445	258	832
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		5.27s	8,211	222	0

Culture générale	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
GPT-5.5	2.8	1.6	33.3%	1		37.86s	195	30	1,754
Qwen3.6 Max Preview	3.0	10.0	0.0%	0		1.97s	210	19	0

Comparaison rapide

Changer la paire de comparaison