AI BENCHY Compare

OpenAI: gpt-oss-120b vs Qwen: Qwen3.5-27B

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-05-29

Métrique	gpt-oss-120b gpt-oss-120b medium Sortie: 2025-08-05 Disponible gratuitement	Qwen3.5-27B Qwen3.5-27B none Sortie: 2026-02-24

Métrique	gpt-oss-120b gpt-oss-120b medium Sortie: 2025-08-05 Disponible gratuitement	Qwen3.5-27B Qwen3.5-27B none Sortie: 2026-02-24
Score	5.9	5.8
Rang	#103	#112
Fiabilité	10.0	10.0
Cohérence	7.9	9.3
Tests corrects
Taux de réussite par tentative	50.0%	40.0%
Tests instables	5	2
Exécutions totales	60	60
Coût par résultat	0.151	0.241
Coût total	$0.013	$0.017
Prix d'entrée	$0.039 / 1M	$0.195 / 1M
Prix de sortie	$0.180 / 1M	$1.560 / 1M
Jetons de sortie	17,495	3,585
Jetons de raisonnement	46,878	0
Temps de réponse (moy.)	22.41s	1.69s
Temps de réponse (max)	68.16s	9.39s
Temps de réponse (total)	291.35s	33.82s

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Astuces anti-IA	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
gpt-oss-120b	6.7	9.9	50.0%	0		10.21s	3,518	2,177
Qwen3.5-27B	4.8	10.0	25.0%	0		788ms	267	0

Programmation	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
gpt-oss-120b	3.9	5.6	33.3%	1		47.24s	847	8,618
Qwen3.5-27B	7.3	10.0	50.0%	0		1.98s	408	0

Combiné	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
gpt-oss-120b	10.0	10.0	100.0%	0		31.18s	694	5,072
Qwen3.5-27B	2.8	1.6	33.3%	1		9.39s	1,461	0

Analyse et extraction des données	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
gpt-oss-120b	6.4	5.9	66.7%	1		1.98s	241	1,114
Qwen3.5-27B	10.0	10.0	100.0%	0		1.43s	243	0

Spécifique au domaine	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
gpt-oss-120b	2.9	4.4	22.2%	2		50.92s	6,784	20,606
Qwen3.5-27B	3.0	10.0	0.0%	0		540ms	15	0

Intelligence générale	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
gpt-oss-120b	4.3	10.0	0.0%	0		7.90s	107	387
Qwen3.5-27B	5.0	10.0	0.0%	0		2.51s	126	0

Suivi des instructions	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
gpt-oss-120b	9.9	10.0	100.0%	0		7.63s	126	1,799
Qwen3.5-27B	6.3	10.0	50.0%	0		1.03s	69	0

Résolution d'énigmes	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
gpt-oss-120b	5.3	7.2	44.4%	1		21.71s	1,790	2,264
Qwen3.5-27B	6.7	7.9	55.6%	1		1.38s	683	0

Appel d'outils	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
gpt-oss-120b	9.8	10.0	100.0%	0		6.91s	287	1,083
Qwen3.5-27B	10.0	10.0	100.0%	0		3.54s	303	0

Culture générale	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
gpt-oss-120b	3.0	10.0	0.0%	0		26.51s	3,101	3,758
Qwen3.5-27B	3.0	10.0	0.0%	0		599ms	10	0

Comparaison rapide

Changer la paire de comparaison

gpt-oss-120bmediumDisponible gratuitementvsQwen3.5-Flashnone gpt-oss-120bmediumDisponible gratuitementvsGLM 5V Turbonone CobuddymediumvsQwen3.5-27Bnone Seed-2.0-Litenonevsgpt-oss-120bmediumDisponible gratuitement gpt-oss-120bmediumDisponible gratuitementvsGLM 5.1none gpt-oss-120bmediumDisponible gratuitementvsQwen3.5 Plus 2026-04-20none Owl AlphamediumvsQwen3.5-27Bnone gpt-oss-120bmediumDisponible gratuitementvsQwen3.5-35B-A3Bnone gpt-oss-120bmediumDisponible gratuitementvsQwen3.6 27Bnone Nemotron 3 SupermediumDisponible gratuitementvsQwen3.5-27Bnone gpt-oss-120bmediumDisponible gratuitementvsMiMo-V2-Pronone gpt-oss-120bmediumDisponible gratuitementvsMiMo-V2-Omninone