AI BENCHY Compare

DeepSeek: DeepSeek V4 Pro vs Owl Alpha

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-04-30

Métrique	DeepSeek V4 Pro DeepSeek V4 Pro none Sortie: 2026-04-24	Owl Alpha Owl Alpha none Sortie: 2026-04-30

Métrique	DeepSeek V4 Pro DeepSeek V4 Pro none Sortie: 2026-04-24	Owl Alpha Owl Alpha none Sortie: 2026-04-30
Score	6.1	6.0
Rang	#82	#87
Fiabilité	7.9	10.0
Cohérence	8.7	9.1
Tests corrects
Taux de réussite par tentative	48.2%	46.3%
Tests instables	3	2
Exécutions totales	54	54
Coût par résultat	0.601	0.000
Coût total	$0.043	$0.000
Prix d'entrée	$0.435 / 1M	$0.000 / 1M
Prix de sortie	$0.870 / 1M	$0.000 / 1M
Jetons de sortie	3,903	1,671
Jetons de raisonnement	0	0
Temps de réponse (moy.)	14.01s	7.07s
Temps de réponse (max)	58.65s	32.27s
Temps de réponse (total)	252.12s	127.23s

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Astuces anti-IA	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
DeepSeek V4 Pro	3.5	8.0	16.7%	1		14.02s	704	0
Owl Alpha	3.4	7.9	16.7%	1		2.78s	57	0

Programmation	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
DeepSeek V4 Pro	7.1	3.7	66.7%	1		14.69s	510	0
Owl Alpha	10.0	10.0	100.0%	0		32.27s	450	0

Combiné	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
DeepSeek V4 Pro	9.5	10.0	100.0%	0		25.49s	1,911	0
Owl Alpha	3.0	10.0	0.0%	0		21.74s	315	0

Analyse et extraction des données	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
DeepSeek V4 Pro	8.8	10.0	100.0%	0		30.54s	170	0
Owl Alpha	10.0	10.0	100.0%	0		3.60s	246	0

Spécifique au domaine	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
DeepSeek V4 Pro	5.3	10.0	33.3%	0		3.17s	18	0
Owl Alpha	5.3	10.0	33.3%	0		3.00s	27	0

Intelligence générale	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
DeepSeek V4 Pro	4.3	9.9	0.0%	0		3.75s	132	0
Owl Alpha	4.3	10.0	0.0%	0		4.61s	80	0

Suivi des instructions	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
DeepSeek V4 Pro	6.3	10.0	50.0%	0		8.23s	64	0
Owl Alpha	6.4	10.0	50.0%	0		2.63s	63	0

Résolution d'énigmes	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
DeepSeek V4 Pro	6.0	7.1	44.4%	1		19.72s	175	0
Owl Alpha	5.9	7.2	55.6%	1		4.43s	202	0

Appel d'outils	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
DeepSeek V4 Pro	10.0	10.0	100.0%	0		5.92s	219	0
Owl Alpha	10.0	10.0	100.0%	0		22.78s	231	0

Comparaison rapide

Changer la paire de comparaison

DeepSeek V4 PrononevsLaguna Xs.2mediumDisponible gratuitement gpt-oss-120bmediumDisponible gratuitementvsOwl Alphanone Owl AlphanonevsLaguna Xs.2mediumDisponible gratuitement DeepSeek V4 Prononevsgpt-oss-120bmediumDisponible gratuitement DeepSeek V4 PrononevsOwl Alphamedium DeepSeek V4 PrononevsLaguna M.1mediumDisponible gratuitement DeepSeek V4 PrononevsGPT-5 Nanomedium Mistral Small 4mediumvsOwl Alphanone MiniMax M2.5mediumDisponible gratuitementvsOwl Alphanone Owl AlphanonevsLaguna M.1mediumDisponible gratuitement GPT-5 NanomediumvsOwl Alphanone DeepSeek V4 PrononevsMercury 2medium