AI BENCHY Compare

Anthropic: Claude Opus 4.7 vs Qwen: Qwen3.5 Plus 2026-02-15

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-04-16

Métrique	Claude Opus 4.7 Claude Opus 4.7 none Sortie: 2026-04-16	Qwen3.5 Plus 2026-02-15 Qwen3.5 Plus 2026-02-15 medium Sortie: 2026-02-15

Métrique	Claude Opus 4.7 Claude Opus 4.7 none Sortie: 2026-04-16	Qwen3.5 Plus 2026-02-15 Qwen3.5 Plus 2026-02-15 medium Sortie: 2026-02-15
Score	9.2	8.5
Rang	#4	#8
Cohérence	10.0	9.1
Tests corrects
Taux de réussite par tentative	88.9%	83.3%
Tests instables	0	2
Exécutions totales	54	54
Coût par résultat	3.155	1.566
Coût total	$0.505	$0.220
Prix d'entrée	$5.000 / 1M	$0.260 / 1M
Prix de sortie	$25.000 / 1M	$1.560 / 1M
Jetons de sortie	6,326	2,121
Jetons de raisonnement	0	111,889
Temps de réponse (moy.)	3.13s	46.56s
Temps de réponse (max)	18.27s	120.91s
Temps de réponse (total)	56.33s	512.20s

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Astuces anti-IA	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Claude Opus 4.7	8.3	10.0	75.0%	0		2.12s	522	0
Qwen3.5 Plus 2026-02-15	8.2	7.9	83.3%	1		45.78s	205	21,236

Programmation	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Claude Opus 4.7	10.0	10.0	100.0%	0		2.84s	494	0
Qwen3.5 Plus 2026-02-15	10.0	10.0	100.0%	0		120.91s	367	19,367

Combiné	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Claude Opus 4.7	9.5	10.0	100.0%	0		18.27s	3,504	0
Qwen3.5 Plus 2026-02-15	10.0	10.0	100.0%	0		46.85s	421	7,906

Analyse et extraction des données	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Claude Opus 4.7	10.0	10.0	100.0%	0		2.15s	324	0
Qwen3.5 Plus 2026-02-15	10.0	10.0	100.0%	0		46.91s	270	14,916

Spécifique au domaine	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Claude Opus 4.7	7.7	10.0	66.7%	0		1.19s	78	0
Qwen3.5 Plus 2026-02-15	5.3	10.0	33.3%	0		17.50s	35	16,680

Intelligence générale	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Claude Opus 4.7	10.0	10.0	100.0%	0		3.47s	257	0
Qwen3.5 Plus 2026-02-15	4.7	1.6	66.7%	1		79.86s	73	8,675

Suivi des instructions	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Claude Opus 4.7	10.0	10.0	100.0%	0		1.46s	114	0
Qwen3.5 Plus 2026-02-15	10.0	10.0	100.0%	0		31.93s	101	7,704

Résolution d'énigmes	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Claude Opus 4.7	10.0	10.0	100.0%	0		2.58s	661	0
Qwen3.5 Plus 2026-02-15	10.0	10.0	100.0%	0		34.57s	340	14,496

Appel d'outils	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Claude Opus 4.7	10.0	10.0	100.0%	0		4.74s	372	0
Qwen3.5 Plus 2026-02-15	10.0	10.0	100.0%	0		7.54s	309	909

Comparaison rapide

Changer la paire de comparaison

Gemini 3 Flash PreviewlowvsQwen3.5 Plus 2026-02-15medium Claude Opus 4.7nonevsGemini 3 Flash Previewlow Gemini 3 Flash PreviewnonevsQwen3.5 Plus 2026-02-15medium Claude Opus 4.7nonevsGemini 3.1 Pro Previewmedium Gemini 3.1 Flash Lite PreviewlowvsQwen3.5 Plus 2026-02-15medium GPT-5.2 ChatnonevsQwen3.5 Plus 2026-02-15medium Claude Opus 4.7nonevsSeed-2.0-Litemedium Gemini 3.1 Flash Lite PreviewnonevsQwen3.5 Plus 2026-02-15medium Claude Opus 4.7nonevsGPT-5.3-Codexmedium Claude Opus 4.7nonevsQwen3.6 Plus PreviewmediumDisponible gratuitement Claude Opus 4.7nonevsQwen3.5-27Bmedium Claude Opus 4.7nonevsGemini 3 PRO Previewmedium