AI BENCHY Compare

Anthropic: Claude Opus 4.8 vs Qwen: Qwen3.6 35B A3B

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-06-03

Métrique	Claude Opus 4.8 Claude Opus 4.8 none Sortie: 2026-05-28	Qwen3.6 35B A3B Qwen3.6 35B A3B medium Sortie: 2026-04-20

Métrique	Claude Opus 4.8 Claude Opus 4.8 none Sortie: 2026-05-28	Qwen3.6 35B A3B Qwen3.6 35B A3B medium Sortie: 2026-04-20
Score	7.3	7.3
Rang	#62	#58
Fiabilité	10.0	10.0
Cohérence	9.2	9.6
Tests corrects
Taux de réussite par tentative	65.0%	61.7%
Tests instables	2	1
Exécutions totales	60	60
Coût par résultat	4.324	1.048
Coût total	$0.519	$0.130
Prix d'entrée	$5.000 / 1M	$0.140 / 1M
Prix de sortie	$25.000 / 1M	$1.000 / 1M
Total des jetons d'entrée	63,282	13,550
Jetons de sortie	8,098	18,304
Jetons de raisonnement	0	115,531
Temps de réponse (moy.)	3.51s	17.26s
Temps de réponse (max)	17.73s	86.11s
Temps de réponse (total)	70.19s	310.65s

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Astuces anti-IA	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Claude Opus 4.8	6.5	10.0	50.0%	0		3.40s	834	1,472	0
Qwen3.6 35B A3B	10.0	10.0	100.0%	0		6.02s	672	1,154	12,385

Programmation	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Claude Opus 4.8	6.8	10.0	50.0%	0		3.59s	6,768	1,323	0
Qwen3.6 35B A3B	6.6	10.0	50.0%	0		59.35s	2,216	6,601	22,535

Combiné	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Claude Opus 4.8	9.5	10.0	100.0%	0		17.73s	29,658	3,259	0
Qwen3.6 35B A3B	3.0	10.0	0.0%	0		0ms	0	0	0

Analyse et extraction des données	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Claude Opus 4.8	7.3	5.8	83.3%	1		1.77s	10,503	308	0
Qwen3.6 35B A3B	10.0	10.0	100.0%	0		12.99s	7,776	2,591	9,968

Spécifique au domaine	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Claude Opus 4.8	5.3	7.2	44.4%	1		1.66s	975	61	0
Qwen3.6 35B A3B	5.3	7.2	44.4%	1		22.50s	771	6,193	39,116

Intelligence générale	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Claude Opus 4.8	10.0	10.0	100.0%	0		3.48s	708	230	0
Qwen3.6 35B A3B	4.4	9.9	0.0%	0		8.66s	516	129	4,569

Suivi des instructions	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Claude Opus 4.8	9.9	10.0	100.0%	0		1.37s	909	95	0
Qwen3.6 35B A3B	10.0	10.0	100.0%	0		7.50s	699	219	7,404

Résolution d'énigmes	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Claude Opus 4.8	7.7	10.0	66.7%	0		2.74s	894	783	0
Qwen3.6 35B A3B	8.0	10.0	66.7%	0		5.95s	696	655	9,228

Appel d'outils	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Claude Opus 4.8	10.0	10.0	100.0%	0		5.35s	11,775	355	0
Qwen3.6 35B A3B	3.0	10.0	0.0%	0		0ms	0	0	0

Culture générale	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Claude Opus 4.8	3.0	10.0	0.0%	0		3.41s	258	212	0
Qwen3.6 35B A3B	3.0	10.0	0.0%	0		32.90s	204	762	10,326

Comparaison rapide

Changer la paire de comparaison

Claude Opus 4.8nonevsQwen3.5-35B-A3Bmedium Qwen3.6 35B A3BmediumvsStep 3.7 Flashlow Claude Opus 4.8nonevsGPT-5.4 Minimedium Claude Opus 4.8nonevsGPT-5.2medium GPT-5.3 ChatnonevsQwen3.6 35B A3Bmedium Claude Opus 4.8nonevsGLM 5V Turbomedium Gemini 3.1 Flash LitelowvsQwen3.6 35B A3Bmedium Claude Opus 4.8nonevsGPT-5.4 Nanomedium Claude Opus 4.8nonevsStep 3.7 Flashhigh Claude Opus 4.8nonevsMiniMax M3medium Claude Opus 4.8nonevsStep 3.7 Flashlow Claude Opus 4.8nonevsGPT-5 Minimedium