#134 Mercury 2.5
high- Coût
- $0.001
- Temps
- 3.5s
- Tokens
- 2,447 tok
Résumé
Mercury 2.5 obtient 7.1 sur AI BENCHY et se classe #134. Il affiche une fiabilité de 9.7, un taux de réussite de 62.1%, un coût total de $0.031 et un temps de réponse moyen de 4.32s.
Ce qui rend Mercury 2.5 unique : Il se distingue surtout en Résolution d'énigmes, où il se classe #2, tandis que Suivi des instructions est son point le plus faible avec #15. Son coût total de benchmark est inhabituellement bas pour son niveau de score.
Date de recherche : 2026-09-08
Meilleure estimation fondée sur les informations publiques ; le fournisseur n’a pas communiqué toutes les valeurs.
7.1
Cohérence
8.6
9.7
$0.031
Total des jetons de sortie
174,547
Total des jetons d'entrée
120,068
Prix d'entrée
$0.040 / 1M
Prix de sortie
$0.150 / 1M
Tests instables
4
Les tests instables ont eu des résultats mixtes entre exécutions (au moins une réussite et un échec).
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
Choisissez d'abord le premier modèle, puis cliquez sur un second modèle pour ouvrir une page côte à côte.
| Catégorie | Score | Cohérence | Tests corrects |
|---|---|---|---|
| Astuces anti-IA | 10.0 | 10.0 | |
| Programmation | 6.4 | 7.8 | |
| Combiné | 6.4 | 5.8 | |
| Analyse et extraction des données | 10.0 | 10.0 | |
| Spécifique au domaine | 2.9 | 7.2 | |
| Intelligence générale | 5.0 | 10.0 | |
| Suivi des instructions | 6.5 | 10.0 | |
| Résolution d'énigmes | 8.7 | 7.7 | |
| Appel d'outils | 10.0 | 10.0 | |
| Culture générale | 3.0 | 10.0 |