Navigation
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Anthropic: Claude Sonnet 4.6 vs Grok 4.20 Beta

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-04-04

Métrique Claude Sonnet 4.6 Claude Sonnet 4.6 medium Sortie: 2026-02-17 Grok 4.20 Beta Grok 4.20 Beta medium Sortie: 2026-03-12
Score 7.9 7.9
Rang #25 #27
Cohérence 9.5 9.0
Tests corrects
Taux de réussite par tentative 72.6% 72.6%
Tests instables 1 2
Exécutions totales 51 51
Coût par résultat 8.531 5.525
Coût total $1.024 $0.608
Prix d'entrée $3.000 / 1M $0.000 / 1M
Prix de sortie $15.000 / 1M $0.000 / 1M
Jetons de sortie 35,174 1,487
Jetons de raisonnement 24,687 87,922
Temps de réponse (moy.) 10.09s 8.54s
Temps de réponse (max) 46.35s 24.21s
Temps de réponse (total) 90.85s 145.26s

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Astuces anti-IA Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Claude Sonnet 4.6 6.5 10.0 50.0% 0 2.98s 1,046 1,093
Grok 4.20 Beta 8.7 7.9 91.7% 1 3.16s 268 7,583
Combiné Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Claude Sonnet 4.6 10.0 10.0 100.0% 0 46.35s 5,871 3,962
Grok 4.20 Beta 10.0 10.0 100.0% 0 20.93s 227 12,212
Analyse et extraction des données Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Claude Sonnet 4.6 10.0 10.0 100.0% 0 13.90s 649 742
Grok 4.20 Beta 10.0 10.0 100.0% 0 4.01s 180 5,281
Spécifique au domaine Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Claude Sonnet 4.6 2.9 7.2 11.1% 1 0ms 25,790 16,919
Grok 4.20 Beta 5.3 10.0 33.3% 0 21.33s 251 40,255
Intelligence générale Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Claude Sonnet 4.6 10.0 10.0 100.0% 0 4.94s 256 433
Grok 4.20 Beta 10.0 10.0 100.0% 0 5.78s 72 3,440
Suivi des instructions Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Claude Sonnet 4.6 10.0 10.0 100.0% 0 2.61s 318 552
Grok 4.20 Beta 8.3 10.0 50.0% 0 4.97s 57 7,107
Puzzle Solving Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Claude Sonnet 4.6 10.0 10.0 100.0% 0 4.80s 589 635
Grok 4.20 Beta 8.2 7.2 88.9% 1 3.85s 249 6,660
Appel d'outils Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Claude Sonnet 4.6 10.0 10.0 100.0% 0 7.48s 655 351
Grok 4.20 Beta 3.0 10.0 0.0% 0 12.39s 183 5,384

Comparaison rapide

Changer la paire de comparaison