Navigation
AI BENCHY
Comparer Graphiques
❤️ Made by XCS
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Inception: Mercury 2 vs xAI: Grok 4.1 Fast

Comparer:

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-03-05

Métrique Inception: Mercury 2 medium Sortie: 2026-02-24 xAI: Grok 4.1 Fast none Sortie: 2025-11-19
Rang #35 #53
Score moy. 5.4 2.9
Tests corrects
Cohérence 8.3 8.9
Coût par résultat 0.622 0.239
Coût total $0.044 $0.008
Taux de réussite par tentative 57.8% 26.7%
Tests instables 3 2
common.totalAttempts 45 (15 x 3) 45 (15 x 3)
Jetons de sortie 3,571 1,036
Jetons de raisonnement 45,379 0
Temps de réponse (moy.) 2.47s 2.01s
Temps de réponse (max) 14.63s 5.51s
Temps de réponse (total) 34.56s 16.06s

Meilleurs modèles par score

Temps de réponse (moy.)

Score vs coût total

Score moy. vs Temps de réponse (moy.)

Répartition par catégorie

Astuces anti-IA Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Inception: Mercury 2 7.3 9.8 66.7% 0 1.30s 2,531 2,410
xAI: Grok 4.1 Fast 1.3 10.0 0.0% 0 1.73s 229 0
Combiné Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Inception: Mercury 2 10.0 10.0 100.0% 0 3.28s 268 4,887
xAI: Grok 4.1 Fast 10.0 10.0 0.0% 0 3.33s 105 0
Analyse et extraction des données Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Inception: Mercury 2 5.5 5.9 83.3% 1 1.11s 183 1,656
xAI: Grok 4.1 Fast 9.9 10.0 100.0% 0 943ms 180 0
Spécifique au domaine Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Inception: Mercury 2 10.0 7.2 11.1% 1 6.48s 41 30,754
xAI: Grok 4.1 Fast 4.0 7.2 55.6% 1 1.06s 15 0
Suivi des instructions Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Inception: Mercury 2 10.0 10.0 100.0% 0 1.07s 14 958
xAI: Grok 4.1 Fast 10.0 10.0 0.0% 0 923ms 56 0
Puzzle Solving Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Inception: Mercury 2 1.7 7.5 22.2% 1 934ms 354 2,758
xAI: Grok 4.1 Fast 1.3 10.0 0.0% 0 1.28s 243 0
Appel d'outils Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons de sortie Jetons de raisonnement
Inception: Mercury 2 10.0 10.0 100.0% 0 1.89s 180 1,956
xAI: Grok 4.1 Fast 10.0 1.6 33.3% 1 5.51s 208 0

Comparaison rapide

Changer la paire de comparaison