AI BENCHY Compare

OpenAI: gpt-oss-120b vs Qwen: Qwen3.6 Max Preview

Résumé

Comparaison benchmark gpt-oss-120b vs Qwen3.6 Max Preview : gpt-oss-120b mène au score moyen avec 6.7 vs 6.0. gpt-oss-120b a le coût de benchmark le plus bas avec $0.013 vs $0.075. Qwen3.6 Max Preview est plus rapide avec 3.30s vs 22.28s, avec des taux de réussite de 52.4% vs 58.7%.

Modèle recommandé: gpt-oss-120b - Il obtient le meilleur score ici (6.7) tout en coûtant environ 6.1x moins que Qwen3.6 Max Preview.

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-06-18

Métrique	gpt-oss-120b gpt-oss-120b medium Sortie: 2025-08-05 Disponible gratuitement	Qwen3.6 Max Preview Qwen3.6 Max Preview none Sortie: 2026-04-20

Métrique	gpt-oss-120b gpt-oss-120b medium Sortie: 2025-08-05 Disponible gratuitement	Qwen3.6 Max Preview Qwen3.6 Max Preview none Sortie: 2026-04-20
Score	6.7	6.0
Rang	#78	#100
Fiabilité	10.0	10.0
Cohérence	8.0	9.2
Tests corrects
Taux de réussite par tentative	52.4%	58.7%
Tests instables	5	2
Exécutions totales	63	63
Coût par résultat	0.141	0.824
Coût total	$0.013	$0.075
Prix d'entrée	$0.039 / 1M	$1.040 / 1M
Prix de sortie	$0.180 / 1M	$6.240 / 1M
Total des jetons d'entrée	39,084	42,509
Jetons de sortie	20,013	4,779
Jetons de raisonnement	50,233	0
Temps de réponse (moy.)	22.28s	3.30s
Temps de réponse (max)	68.16s	20.51s
Temps de réponse (total)	311.96s	69.40s

Génération showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#78 gpt-oss-120b

medium

Coût: $0.001
Temps: 26.7s
Tokens: 555 tok

#100 Qwen3.6 Max Preview

none

Coût: $0.025
Temps: 83.9s
Tokens: 4,066 tok

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Astuces anti-IA	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
gpt-oss-120b	6.7	9.9	50.0%	0		10.21s	1,314	3,518	2,177
Qwen3.6 Max Preview	5.2	7.9	41.7%	1		2.63s	696	513	0

Programmation	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
gpt-oss-120b	5.9	7.0	55.6%	1		38.37s	7,782	3,365	11,973
Qwen3.6 Max Preview	3.8	7.3	22.2%	1		3.12s	7,913	456	0

Combiné	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
gpt-oss-120b	10.0	10.0	100.0%	0		31.18s	11,535	694	5,072
Qwen3.6 Max Preview	3.0	10.0	0.0%	0		20.51s	14,949	2,842	0

Analyse et extraction des données	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
gpt-oss-120b	6.4	5.9	66.7%	1		1.98s	7,476	241	1,114
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		2.87s	7,794	243	0

Spécifique au domaine	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
gpt-oss-120b	2.9	4.4	22.2%	2		50.92s	1,266	6,784	20,606
Qwen3.6 Max Preview	7.7	10.0	66.7%	0		1.22s	789	18	0

Intelligence générale	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
gpt-oss-120b	4.3	10.0	0.0%	0		7.90s	659	107	387
Qwen3.6 Max Preview	4.3	10.0	0.0%	0		1.62s	522	76	0

Suivi des instructions	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
gpt-oss-120b	9.9	10.0	100.0%	0		7.63s	1,036	126	1,799
Qwen3.6 Max Preview	9.8	10.0	100.0%	0		1.40s	711	69	0

Résolution d'énigmes	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
gpt-oss-120b	5.3	7.2	44.4%	1		21.71s	1,190	1,790	2,264
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		2.65s	714	321	0

Appel d'outils	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
gpt-oss-120b	9.8	10.0	100.0%	0		6.91s	6,514	287	1,083
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		5.27s	8,211	222	0

Culture générale	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
gpt-oss-120b	3.0	10.0	0.0%	0		26.51s	312	3,101	3,758
Qwen3.6 Max Preview	3.0	10.0	0.0%	0		1.97s	210	19	0

Comparaison rapide

Changer la paire de comparaison