Navigation
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Inception: Mercury 2 vs Qwen: Qwen3.5 Plus 2026-04-20

Résumé

Comparaison benchmark Mercury 2 vs Qwen3.5 Plus 2026-04-20 : Qwen3.5 Plus 2026-04-20 mène au score moyen avec 5.5 vs 4.6. Mercury 2 a le coût de benchmark le plus bas avec $0.011 vs $0.032. Mercury 2 est plus rapide avec 653ms vs 4.39s, avec des taux de réussite de 23.8% vs 41.3%.

Modèle recommandé: Mercury 2 - Il offre le meilleur compromis global: score compétitif (4.6), coût inférieur à Qwen3.5 Plus 2026-04-20 et temps de réponse équilibré.

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-06-18

Métrique Mercury 2 Mercury 2 none Sortie: 2026-02-24 Qwen3.5 Plus 2026-04-20 Qwen3.5 Plus 2026-04-20 none Sortie: 2026-04-20
Score 4.6 5.5
Rang #151 #122
Fiabilité 10.0 10.0
Cohérence 9.2 8.6
Tests corrects
Taux de réussite par tentative 23.8% 41.3%
Tests instables 2 4
Exécutions totales 63 63
Coût par résultat 0.259 0.595
Coût total $0.011 $0.032
Prix d'entrée $0.250 / 1M $0.300 / 1M
Prix de sortie $0.750 / 1M $1.800 / 1M
Total des jetons d'entrée 28,113 38,910
Jetons de sortie 4,439 11,145
Jetons de raisonnement 0 0
Temps de réponse (moy.) 653ms 4.39s
Temps de réponse (max) 1.43s 33.34s
Temps de réponse (total) 13.72s 92.26s

Génération showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#151 Mercury 2

none
Coût
$0.002
Temps
1.8s
Tokens
1,514 tok

#122 Qwen3.5 Plus 2026-04-20

none
Coût
$0.008
Temps
77.0s
Tokens
4,369 tok

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Astuces anti-IA Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Mercury 2 3.0 10.0 0.0% 0 483ms 631 286 0
Qwen3.5 Plus 2026-04-20 4.8 10.0 25.0% 0 1.88s 696 557 0
Programmation Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Mercury 2 3.4 9.6 0.0% 0 1.03s 7,229 3,088 0
Qwen3.5 Plus 2026-04-20 3.9 7.8 11.1% 1 1.69s 7,913 480 0
Combiné Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Mercury 2 3.0 10.0 0.0% 0 606ms 4,821 131 0
Qwen3.5 Plus 2026-04-20 2.8 1.6 33.3% 1 13.32s 11,350 2,275 0
Analyse et extraction des données Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Mercury 2 7.3 5.9 83.3% 1 667ms 6,362 180 0
Qwen3.5 Plus 2026-04-20 10.0 10.0 100.0% 0 2.82s 7,794 243 0
Spécifique au domaine Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Mercury 2 5.3 7.2 44.4% 1 534ms 784 46 0
Qwen3.5 Plus 2026-04-20 5.3 10.0 33.3% 0 4.43s 789 18 0
Intelligence générale Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Mercury 2 4.8 10.0 0.0% 0 628ms 495 159 0
Qwen3.5 Plus 2026-04-20 4.8 10.0 0.0% 0 1.41s 522 119 0
Suivi des instructions Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Mercury 2 6.5 10.0 50.0% 0 551ms 691 82 0
Qwen3.5 Plus 2026-04-20 6.2 5.8 66.7% 1 1.17s 711 68 0
Résolution d'énigmes Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Mercury 2 3.1 10.0 0.0% 0 535ms 694 251 0
Qwen3.5 Plus 2026-04-20 6.7 7.9 55.6% 1 1.97s 714 583 0
Appel d'outils Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Mercury 2 10.0 10.0 100.0% 0 1.27s 6,193 197 0
Qwen3.5 Plus 2026-04-20 10.0 10.0 100.0% 0 4.42s 8,211 297 0
Culture générale Score Cohérence Taux de réussite par tentative Tests instables Tests corrects Temps de réponse (moy.) Jetons d'entrée Jetons de sortie Jetons de raisonnement
Mercury 2 3.0 10.0 0.0% 0 548ms 213 19 0
Qwen3.5 Plus 2026-04-20 3.0 10.0 0.0% 0 33.34s 210 6,505 0

Comparaison rapide

Changer la paire de comparaison