AI BENCHY Compare

OpenAI: gpt-oss-120b vs Qwen: Qwen3.5-122B-A10B

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-06-01

Métrique	gpt-oss-120b gpt-oss-120b medium Sortie: 2025-08-05 Disponible gratuitement	Qwen3.5-122B-A10B Qwen3.5-122B-A10B none Sortie: 2026-02-24

Métrique	gpt-oss-120b gpt-oss-120b medium Sortie: 2025-08-05 Disponible gratuitement	Qwen3.5-122B-A10B Qwen3.5-122B-A10B none Sortie: 2026-02-24
Score	5.9	5.4
Rang	#103	#131
Fiabilité	10.0	10.0
Cohérence	7.9	9.5
Tests corrects
Taux de réussite par tentative	50.0%	33.3%
Tests instables	5	1
Exécutions totales	60	60
Coût par résultat	0.151	0.380
Coût total	$0.012	$0.019
Prix d'entrée	$0.000 / 1M	$0.260 / 1M
Prix de sortie	$0.000 / 1M	$2.080 / 1M
Jetons de sortie	17,495	3,374
Jetons de raisonnement	46,878	0
Temps de réponse (moy.)	22.41s	3.38s
Temps de réponse (max)	68.16s	46.00s
Temps de réponse (total)	291.35s	67.55s

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Astuces anti-IA	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
gpt-oss-120b	6.7	9.9	50.0%	0		10.21s	3,518	2,177
Qwen3.5-122B-A10B	4.8	10.0	25.0%	0		1.59s	312	0

Programmation	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
gpt-oss-120b	3.9	5.6	33.3%	1		47.24s	847	8,618
Qwen3.5-122B-A10B	4.0	5.5	33.3%	1		2.14s	684	0

Combiné	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
gpt-oss-120b	10.0	10.0	100.0%	0		31.18s	694	5,072
Qwen3.5-122B-A10B	3.0	10.0	0.0%	0		46.00s	1,137	0

Analyse et extraction des données	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
gpt-oss-120b	6.4	5.9	66.7%	1		1.98s	241	1,114
Qwen3.5-122B-A10B	10.0	10.0	100.0%	0		1.01s	243	0

Spécifique au domaine	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
gpt-oss-120b	2.9	4.4	22.2%	2		50.92s	6,784	20,606
Qwen3.5-122B-A10B	5.3	10.0	33.3%	0		465ms	15	0

Intelligence générale	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
gpt-oss-120b	4.3	10.0	0.0%	0		7.90s	107	387
Qwen3.5-122B-A10B	5.0	10.0	0.0%	0		1.12s	66	0

Suivi des instructions	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
gpt-oss-120b	9.9	10.0	100.0%	0		7.63s	126	1,799
Qwen3.5-122B-A10B	6.3	10.0	50.0%	0		513ms	69	0

Résolution d'énigmes	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
gpt-oss-120b	5.3	7.2	44.4%	1		21.71s	1,790	2,264
Qwen3.5-122B-A10B	3.8	10.0	0.0%	0		1.00s	575	0

Appel d'outils	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
gpt-oss-120b	9.8	10.0	100.0%	0		6.91s	287	1,083
Qwen3.5-122B-A10B	10.0	10.0	100.0%	0		2.04s	264	0

Culture générale	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
gpt-oss-120b	3.0	10.0	0.0%	0		26.51s	3,101	3,758
Qwen3.5-122B-A10B	3.0	10.0	0.0%	0		295ms	9	0

Comparaison rapide

Changer la paire de comparaison

gpt-oss-120bmediumDisponible gratuitementvsQwen3.5-Flashnone gpt-oss-120bmediumDisponible gratuitementvsGLM 5V Turbonone MiniMax M2.7mediumvsQwen3.5-122B-A10Bnone Elephant AlphamediumvsQwen3.5-122B-A10Bnone Seed-2.0-Litenonevsgpt-oss-120bmediumDisponible gratuitement Mistral Small 4mediumvsQwen3.5-122B-A10Bnone gpt-oss-120bmediumDisponible gratuitementvsGLM 5.1none MiniMax M2.5mediumvsQwen3.5-122B-A10Bnone DeepSeek V4 Prononevsgpt-oss-120bmediumDisponible gratuitement gpt-oss-120bmediumDisponible gratuitementvsQwen3.5 Plus 2026-04-20none gpt-oss-120bmediumDisponible gratuitementvsQwen3.5-35B-A3Bnone gpt-oss-120bmediumDisponible gratuitementvsQwen3.5-27Bnone