- Rang
- #280
- Total des jetons de sortie
- 118,380
- Temps de réponse (moy.)
- 39.90s
- Coût total
- $0.000
Cobuddy (medium) vs Mercury 2
Le score moyen est pratiquement à égalité avec 4.7 vs 4.7. Cobuddy (medium) a le coût de benchmark le plus bas avec $0.000 vs $0.030. Mercury 2 est plus rapide avec 825ms vs 39.90s, avec des taux de réussite de 45.5% vs 24.2%.
- Rang
- #281
- Total des jetons de sortie
- 9,584
- Temps de réponse (moy.)
- 825ms
- Coût total
- $0.030
Modèle recommandé
Mercury 2
Il obtient le meilleur score ici (4.7) et répond environ 48.4x plus vite que Cobuddy (medium).
Comparaison détaillée
| Métrique | Cobuddy Cobuddy medium | Mercury 2 Mercury 2 none |
|---|---|---|
| Score | 4.7 | 4.7 |
| Rang | #280 | #281 |
| Fiabilité | 10.0 | 10.0 |
| Cohérence | 7.2 | 9.2 |
| Tentatives | 63/66 | 66/66 |
| Tests corrects | ||
| Taux de réussite par tentative | 45.5% | 24.2% |
| Tests instables | 6 | 2 |
| Exécutions totales | 63 | 66 |
| Coût par résultat | 0.000 | 0.740 |
| Coût total | $0.000 | $0.030 |
| Prix d'entrée | $0.000 / 1M | $0.250 / 1M |
| Prix de sortie | $0.000 / 1M | $0.750 / 1M |
| Total des jetons d'entrée | 37,449 | 89,637 |
| Jetons de sortie | 1,677 | 9,584 |
| Jetons de raisonnement | 116,703 | 0 |
| Temps de réponse (moy.) | 39.90s | 825ms |
| Temps de réponse (max) | 309.02s | 4.52s |
| Temps de réponse (total) | 797.98s | 18.14s |
| Paramètres | ~21B au total (~3B actifs) | ~100B |
| Disponibilité | Source fermée | Source fermée |
Génération showcase de modèles
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#280 Cobuddy
medium
No endpoints found for baidu/cobuddy:free.
- Coût
- $0.000
- Temps
- 0.1s
- Tokens
- 0 tok
#281 Mercury 2
none- Coût
- $0.002
- Temps
- 1.8s
- Tokens
- 1,514 tok
Meilleurs modèles par score
Score vs coût total
Temps de réponse (moy.)
Score vs Temps de réponse (moy.)
Total des jetons de sortie
Score vs Total des jetons de sortie
Répartition par catégorie
Comparaison rapide
Changer la paire de comparaison
Granite 4.2 8BhighvsMercury 2noneCobuddymediumvsGranite 4.2 8BhighTrinity Large PreviewnonevsCobuddymediumCobuddymediumvsGLM 4.7 FlashnoneMercury 2nonevsQwen3 Coder NextmediumCobuddymediumvsKAT-Coder-Air V2.5noneMercury 2nonevsMiniMax M2.5mediumTrinity Large ThinkinghighvsCobuddymediumCobuddymediumvsGPT-5.4 NanononeTrinity Large ThinkinghighvsMercury 2noneCobuddymediumvsNemotron 3.5 LightninglowDisponible gratuitementCobuddymediumvsLaguna S 2.1noneDisponible gratuitement