AI BENCHY Compare

inclusionAI: Ling-2.6-flash vs Qwen: Qwen3.5 Plus 2026-04-20

Résumé

Comparaison benchmark Ling-2.6-flash vs Qwen3.5 Plus 2026-04-20 : Qwen3.5 Plus 2026-04-20 mène au score moyen avec 5.7 vs 5.0. Ling-2.6-flash a le coût de benchmark le plus bas avec $0.001 vs $0.032. Qwen3.5 Plus 2026-04-20 est plus rapide avec 4.39s vs 9.34s, avec des taux de réussite de 31.8% vs 41.3%.

Modèle recommandé: Ling-2.6-flash - Son score reste proche du meilleur score ici (5.0 vs 5.7) tout en coûtant environ 64.3x moins que Qwen3.5 Plus 2026-04-20.

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-06-04

Métrique	Ling-2.6-flash Ling-2.6-flash none Sortie: 2026-04-21	Qwen3.5 Plus 2026-04-20 Qwen3.5 Plus 2026-04-20 none Sortie: 2026-04-20

Métrique	Ling-2.6-flash Ling-2.6-flash none Sortie: 2026-04-21	Qwen3.5 Plus 2026-04-20 Qwen3.5 Plus 2026-04-20 none Sortie: 2026-04-20
Score	5.0	5.7
Rang	#138	#114
Fiabilité	10.0	10.0
Cohérence	9.2	8.6
Tests corrects
Taux de réussite par tentative	31.8%	41.3%
Tests instables	2	4
Exécutions totales	63	63
Coût par résultat	0.005	0.595
Coût total	$0.001	$0.032
Prix d'entrée	$0.010 / 1M	$0.300 / 1M
Prix de sortie	$0.030 / 1M	$1.800 / 1M
Total des jetons d'entrée	40,718	38,910
Jetons de sortie	2,878	11,145
Jetons de raisonnement	0	0
Temps de réponse (moy.)	9.34s	4.39s
Temps de réponse (max)	35.34s	33.34s
Temps de réponse (total)	177.48s	92.26s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#138 Ling-2.6-flash

none

No showcase result has been generated for this model yet.

Cost: $0.000
Time: -
Tokens: 0 tok

#114 Qwen3.5 Plus 2026-04-20

none

Cost: $0.008
Time: 77.0s
Tokens: 4,369 tok

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Astuces anti-IA	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Ling-2.6-flash	6.8	8.1	58.3%	1		11.81s	726	573	0
Qwen3.5 Plus 2026-04-20	4.8	10.0	25.0%	0		1.88s	696	557	0

Programmation	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Ling-2.6-flash	5.3	10.0	33.3%	0		11.21s	813	381	0
Qwen3.5 Plus 2026-04-20	3.9	7.8	11.1%	1		1.69s	7,913	480	0

Combiné	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Ling-2.6-flash	3.0	10.0	0.0%	0		35.34s	20,818	1,069	0
Qwen3.5 Plus 2026-04-20	2.8	1.6	33.3%	1		13.32s	11,350	2,275	0

Analyse et extraction des données	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Ling-2.6-flash	6.5	10.0	50.0%	0		8.48s	8,004	246	0
Qwen3.5 Plus 2026-04-20	10.0	10.0	100.0%	0		2.82s	7,794	243	0

Spécifique au domaine	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Ling-2.6-flash	3.0	10.0	0.0%	0		4.95s	810	24	0
Qwen3.5 Plus 2026-04-20	5.3	10.0	33.3%	0		4.43s	789	18	0

Intelligence générale	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Ling-2.6-flash	4.0	10.0	0.0%	0		1.45s	540	109	0
Qwen3.5 Plus 2026-04-20	4.8	10.0	0.0%	0		1.41s	522	119	0

Suivi des instructions	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Ling-2.6-flash	9.8	10.0	100.0%	0		5.52s	732	81	0
Qwen3.5 Plus 2026-04-20	6.2	5.8	66.7%	1		1.17s	711	68	0

Résolution d'énigmes	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Ling-2.6-flash	2.9	7.2	11.1%	1		6.51s	729	151	0
Qwen3.5 Plus 2026-04-20	6.7	7.9	55.6%	1		1.97s	714	583	0

Appel d'outils	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Ling-2.6-flash	3.0	10.0	0.0%	0		18.80s	7,324	229	0
Qwen3.5 Plus 2026-04-20	10.0	10.0	100.0%	0		4.42s	8,211	297	0

Culture générale	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
Ling-2.6-flash	3.0	10.0	0.0%	0		1.06s	222	15	0
Qwen3.5 Plus 2026-04-20	3.0	10.0	0.0%	0		33.34s	210	6,505	0

Comparaison rapide

Changer la paire de comparaison

CobuddymediumvsQwen3.5 Plus 2026-04-20none Nemotron 3 SupermediumDisponible gratuitementvsQwen3.5 Plus 2026-04-20none Ling-2.6-flashnonevsMistral Small 4medium Ling-2.6-flashnonevsMiniMax M2.7medium Ling-2.6-flashnonevsMiniMax M2.5medium DeepSeek V4 ProhighvsQwen3.5 Plus 2026-04-20none MiniMax M2.5mediumvsQwen3.5 Plus 2026-04-20none MiniMax M2.7mediumvsQwen3.5 Plus 2026-04-20none Mistral Small 4mediumvsQwen3.5 Plus 2026-04-20none Ling-2.6-flashnonevsQwen3 Coder Nextmedium gpt-oss-120bmediumDisponible gratuitementvsQwen3.5 Plus 2026-04-20none CobuddymediumvsLing-2.6-flashnone