Navigation
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Inception: Mercury 2 vs Qwen: Qwen3.7 Plus

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-06-03

Métrique Mercury 2 Mercury 2 medium Sortie: 2026-02-24 Qwen3.7 Plus Qwen3.7 Plus none Sortie: 2026-06-03
Score 6.5 6.6
Rang #89 #82
Fiabilité 10.0 10.0
Cohérence 8.8 10.0
Tests corrects
Taux de réussite par tentative 51.7% 50.0%
Tests instables 3 0
Exécutions totales 60 60
Coût par résultat 0.611 0.264
Coût total $0.055 $0.027
Prix d'entrée $0.250 / 1M $0.400 / 1M
Prix de sortie $0.750 / 1M $1.600 / 1M
Total des jetons d'entrée 32,570 39,669
Jetons de sortie 4,022 6,572
Jetons de raisonnement 58,405 0
Temps de réponse (moy.) 2.27s 2.95s
Temps de réponse (max) 14.63s 29.38s
Temps de réponse (total) 43.20s 58.96s

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Astuces anti-IA Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Mercury 2 6.9 9.9 50.0% 0 1.12s 554 2,546 2,609
Qwen3.7 Plus 6.5 10.0 50.0% 0 1.38s 696 349 0
Programmation Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Mercury 2 7.2 6.5 66.7% 1 2.29s 4,519 270 8,514
Qwen3.7 Plus 6.8 10.0 50.0% 0 2.77s 5,070 633 0
Combiné Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Mercury 2 10.0 10.0 100.0% 0 3.28s 12,909 268 4,887
Qwen3.7 Plus 10.0 10.0 100.0% 0 29.38s 14,952 4,505 0
Analyse et extraction des données Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Mercury 2 7.3 5.9 83.3% 1 1.11s 6,234 183 1,656
Qwen3.7 Plus 10.0 10.0 100.0% 0 1.43s 7,794 243 0
Spécifique au domaine Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Mercury 2 2.9 7.2 11.1% 1 6.48s 695 41 30,754
Qwen3.7 Plus 3.0 10.0 0.0% 0 868ms 789 18 0
Intelligence générale Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Mercury 2 4.8 10.0 0.0% 0 821ms 456 137 542
Qwen3.7 Plus 5.3 10.0 0.0% 0 1.33s 522 78 0
Suivi des instructions Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Mercury 2 10.0 10.0 100.0% 0 1.07s 340 14 958
Qwen3.7 Plus 6.3 10.0 50.0% 0 929ms 711 72 0
Résolution d'énigmes Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Mercury 2 5.4 10.0 33.3% 0 949ms 601 361 2,781
Qwen3.7 Plus 7.7 10.0 66.7% 0 1.71s 714 443 0
Appel d'outils Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Mercury 2 10.0 10.0 100.0% 0 1.89s 6,080 180 1,956
Qwen3.7 Plus 10.0 10.0 100.0% 0 3.54s 8,211 222 0
Culture générale Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Mercury 2 3.0 10.0 0.0% 0 2.58s 182 22 3,748
Qwen3.7 Plus 3.0 10.0 0.0% 0 1.21s 210 9 0

Comparaison rapide

Changer la paire de comparaison