Navigation
AI BENCHY
Your ad here

AI BENCHY Compare

Anthropic: Claude Opus 4.7 vs DeepSeek: DeepSeek V4 Pro

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-04-24

Métrique Claude Opus 4.7 Claude Opus 4.7 medium Sortie: 2026-04-16 DeepSeek V4 Pro DeepSeek V4 Pro high Sortie: 2026-04-24
Score 9.2 8.2
Rang #3 #20
Fiabilité N/D N/D
Cohérence 10.0 9.6
Tests corrects
Taux de réussite par tentative 88.9% 74.1%
Tests instables 0 1
Exécutions totales 54 24
Coût par résultat 2.790 1.224
Coût total $0.447 $0.160
Prix d'entrée $5.000 / 1M $1.740 / 1M
Prix de sortie $25.000 / 1M $3.480 / 1M
Jetons de sortie 5,375 671
Jetons de raisonnement 1,341 39,383
Temps de réponse (moy.) 3.53s 71.21s
Temps de réponse (max) 21.45s 351.99s
Temps de réponse (total) 60.03s 1281.73s

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Astuces anti-IA Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Claude Opus 4.7 8.3 10.0 75.0% 0 1.85s 348 0
DeepSeek V4 Pro 8.3 10.0 75.0% 0 26.93s 70 2,008
Programmation Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Claude Opus 4.7 10.0 10.0 100.0% 0 6.41s 1,141 257
DeepSeek V4 Pro 10.0 10.0 100.0% 0 93.00s 82 2,808
Combiné Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Claude Opus 4.7 10.0 10.0 100.0% 0 21.45s 2,369 1,084
DeepSeek V4 Pro 10.0 10.0 100.0% 0 71.08s 134 2,163
Analyse et extraction des données Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Claude Opus 4.7 10.0 10.0 100.0% 0 2.37s 324 0
DeepSeek V4 Pro 10.0 10.0 100.0% 0 63.00s 67 1,071
Spécifique au domaine Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Claude Opus 4.7 7.7 10.0 66.7% 0 1.17s 51 0
DeepSeek V4 Pro 5.3 10.0 33.3% 0 202.56s 11 25,343
Intelligence générale Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Claude Opus 4.7 10.0 10.0 100.0% 0 2.87s 256 0
DeepSeek V4 Pro 5.0 10.0 0.0% 0 26.96s 51 734
Suivi des instructions Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Claude Opus 4.7 10.0 10.0 100.0% 0 1.57s 114 0
DeepSeek V4 Pro 10.0 10.0 100.0% 0 14.60s 21 1,236
Résolution d'énigmes Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Claude Opus 4.7 10.0 10.0 100.0% 0 2.51s 399 0
DeepSeek V4 Pro 7.6 7.4 77.8% 1 69.69s 151 3,847
Appel d'outils Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Claude Opus 4.7 10.0 10.0 100.0% 0 4.17s 373 0
DeepSeek V4 Pro 10.0 10.0 100.0% 0 11.05s 84 173

Comparaison rapide

Changer la paire de comparaison