AI BENCHY Compare

Owl Alpha vs Qwen: Qwen3.5-122B-A10B

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-04-30

Métrique	Owl Alpha Owl Alpha medium Sortie: 2026-04-30	Qwen3.5-122B-A10B Qwen3.5-122B-A10B none Sortie: 2026-02-24

Métrique	Owl Alpha Owl Alpha medium Sortie: 2026-04-30	Qwen3.5-122B-A10B Qwen3.5-122B-A10B none Sortie: 2026-02-24
Score	5.8	5.9
Rang	#91	#88
Fiabilité	10.0	N/D
Cohérence	9.5	9.5
Tests corrects
Taux de réussite par tentative	40.7%	42.6%
Tests instables	1	1
Exécutions totales	54	54
Coût par résultat	0.000	0.308
Coût total	$0.000	$0.022
Prix d'entrée	$0.000 / 1M	$0.260 / 1M
Prix de sortie	$0.000 / 1M	$2.080 / 1M
Jetons de sortie	1,596	3,341
Jetons de raisonnement	0	0
Temps de réponse (moy.)	11.04s	3.69s
Temps de réponse (max)	58.63s	46.00s
Temps de réponse (total)	198.65s	66.50s

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Astuces anti-IA	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Owl Alpha	4.8	10.0	25.0%	0		3.97s	87	0
Qwen3.5-122B-A10B	4.8	10.0	25.0%	0		1.59s	312	0

Programmation	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Owl Alpha	10.0	10.0	100.0%	0		7.35s	402	0
Qwen3.5-122B-A10B	4.3	1.1	66.7%	1		3.44s	659	0

Combiné	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Owl Alpha	3.0	10.0	0.0%	0		10.01s	315	0
Qwen3.5-122B-A10B	3.0	10.0	0.0%	0		46.00s	1,137	0

Analyse et extraction des données	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Owl Alpha	10.0	10.0	100.0%	0		21.64s	246	0
Qwen3.5-122B-A10B	10.0	10.0	100.0%	0		1.01s	243	0

Spécifique au domaine	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Owl Alpha	5.3	10.0	33.3%	0		8.58s	28	0
Qwen3.5-122B-A10B	5.3	10.0	33.3%	0		465ms	15	0

Intelligence générale	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Owl Alpha	4.3	10.0	0.0%	0		58.63s	98	0
Qwen3.5-122B-A10B	5.0	10.0	0.0%	0		1.12s	66	0

Suivi des instructions	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Owl Alpha	6.3	10.0	50.0%	0		9.59s	57	0
Qwen3.5-122B-A10B	6.3	10.0	50.0%	0		585ms	70	0

Résolution d'énigmes	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Owl Alpha	3.4	7.2	11.1%	1		3.44s	135	0
Qwen3.5-122B-A10B	5.4	10.0	33.3%	0		982ms	575	0

Appel d'outils	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Owl Alpha	10.0	10.0	100.0%	0		8.26s	228	0
Qwen3.5-122B-A10B	10.0	10.0	100.0%	0		2.04s	264	0

Comparaison rapide

Changer la paire de comparaison

Kimi K2.6nonevsOwl Alphamedium gpt-oss-120bmediumDisponible gratuitementvsQwen3.5-122B-A10Bnone GPT-5.4nonevsOwl Alphamedium Owl AlphamediumvsQwen3.5 Plus 2026-04-20none Owl AlphamediumvsMiMo-V2.5-Pronone Owl AlphamediumvsQwen3.6 Flashnone Owl AlphamediumvsGLM 5.1none Owl AlphamediumvsMiMo-V2-Pronone DeepSeek V3.2nonevsOwl Alphamedium Owl AlphamediumvsQwen3.5-27Bnone Owl AlphamediumvsQwen3.6 27Bnone DeepSeek V4 PrononevsOwl Alphamedium