- Rang
- #201
- Total des jetons de sortie
- 96,943
- Temps de réponse (moy.)
- 4.40s
- Coût total
- $0.121
Mercury 2 (medium) vs GLM 5.3 (low)
Mercury 2 (medium) mène au score moyen avec 6.6 vs 6.5. Mercury 2 (medium) a le coût de benchmark le plus bas avec $0.121 vs $0.215. Mercury 2 (medium) est plus rapide avec 4.40s vs 15.18s, avec des taux de réussite de 53.6% vs 63.8%.
Modèles comparés
- Rang
- #208
- Total des jetons de sortie
- 28,106
- Temps de réponse (moy.)
- 15.18s
- Coût total
- $0.215
Modèle recommandé
Mercury 2 (medium)
Il obtient le meilleur score ici (6.6) tout en coûtant environ 1.8x moins que GLM 5.3 (low).
Comparaison détaillée
| Métrique | Mercury 2 Mercury 2 medium | GLM 5.3 GLM 5.3 low |
|---|---|---|
| Score | 6.6 | 6.5 |
| Rang | #201 | #208 |
| Fiabilité | 10.0 | 10.0 |
| Cohérence | 8.1 | 8.3 |
| Tentatives | 69/69 | 69/69 |
| Tests corrects | ||
| Taux de réussite par tentative | 53.6% | 63.8% |
| Tests instables | 5 | 5 |
| Exécutions totales | 69 | 69 |
| Coût par résultat | 1.201 | 3.923 |
| Coût total | $0.121 | $0.215 |
| Prix d'entrée | $0.250 / 1M | $0.070 / 1M |
| Prix de sortie | $0.750 / 1M | $7.000 / 1M |
| Prix de lecture du cache | $0.025 / 1M | $0.065 / 1M |
| Prix d’écriture du cache | N/D | N/D |
| Total des jetons d'entrée | 189,300 | 247,871 |
| Jetons de sortie | 10,854 | 10,791 |
| Jetons de raisonnement | 86,089 | 17,315 |
| Temps de réponse (moy.) | 4.40s | 15.18s |
| Temps de réponse (max) | 34.92s | 83.60s |
| Temps de réponse (total) | 96.81s | 349.06s |
| Paramètres | ~100B | 744B au total (40B actifs) |
| Disponibilité | Source fermée | Source fermée |
Les prix du cache concernent les tokens d’entrée. La lecture réutilise les prompts en cache ; l’écriture les stocke et peut coûter plus cher. Les tokens de sortie utilisent le prix de sortie.
Génération showcase de modèles
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#201 Mercury 2
medium- Coût
- $0.002
- Temps
- 2.1s
- Tokens
- 1,702 tok
#208 GLM 5.3
low- Coût
- $0.007
- Temps
- 28.4s
- Tokens
- 1,599 tok
Répartition par catégorie
Comparaison rapide
Changer la paire de comparaison
Mercury 2mediumvsStep 3.7 FlashhighMercury 2.5highvsGLM 5.3lowMercury 2.5 PreviewhighvsGLM 5.3lowKAT-Coder-Pro V2.5highvsGLM 5.3lowGrok 4.3mediumvsGLM 5.3lowMercury 2mediumvsLongCat 2.0lowMercury 2mediumvsKAT-Coder-Pro V2.5lowQwen3.6 35B A3BmediumvsGLM 5.3lowLaguna XS 2.1mediumDisponible gratuitementvsGLM 5.3lowQwen3.5-122B-A10BnonevsGLM 5.3lowClaude Sonnet 5.5mediumvsGLM 5.3lowGemini 3 Flash PreviewnonevsGLM 5.3low