- Rang
- #206
- Total des jetons de sortie
- 138,946
- Temps de réponse (moy.)
- 7.74s
- Coût total
- $0.034
Mercury 2.5 (medium) vs Laguna XS 2.1 (medium)
Laguna XS 2.1 (medium) mène au score moyen avec 6.4 vs 6.4. Mercury 2.5 (medium) a le coût de benchmark le plus bas avec $0.034 vs $0.083. Mercury 2.5 (medium) est plus rapide avec 7.74s vs 48.97s, avec des taux de réussite de 63.8% vs 46.4%.
Modèles comparés
- Rang
- #200
- Total des jetons de sortie
- 538,292
- Temps de réponse (moy.)
- 48.97s
- Coût total
- $0.083
Modèle recommandé
Mercury 2.5 (medium)
Son score reste proche du meilleur score ici (6.4 vs 6.4) tout en coûtant environ 2.5x moins que Laguna XS 2.1 (medium).
Comparaison détaillée
| Métrique | Mercury 2.5 Mercury 2.5 medium | Laguna XS 2.1 Laguna XS 2.1 medium Disponible gratuitement |
|---|---|---|
| Score | 6.4 | 6.4 |
| Rang | #206 | #200 |
| Fiabilité | 9.7 | 10.0 |
| Cohérence | 8.3 | 9.0 |
| Tentatives | 69/69 | 69/69 |
| Tests corrects | ||
| Taux de réussite par tentative | 63.8% | 46.4% |
| Tests instables | 5 | 3 |
| Exécutions totales | 69 | 69 |
| Coût par résultat | 0.280 | 0.922 |
| Coût total | $0.034 | $0.083 |
| Prix d'entrée | $0.040 / 1M | $0.060 / 1M |
| Prix de sortie | $0.150 / 1M | $0.120 / 1M |
| Prix de lecture du cache | $0.004 / 1M | $0.030 / 1M |
| Prix d’écriture du cache | N/D | N/D |
| Total des jetons d'entrée | 317,982 | 352,516 |
| Jetons de sortie | 3,918 | 33,786 |
| Jetons de raisonnement | 135,028 | 504,506 |
| Temps de réponse (moy.) | 7.74s | 48.97s |
| Temps de réponse (max) | 107.89s | 422.72s |
| Temps de réponse (total) | 178.07s | 1126.35s |
| Paramètres | ~100B | 33B au total (3B actifs) |
| Disponibilité | Source fermée | Poids disponibles |
Les prix du cache concernent les tokens d’entrée. La lecture réutilise les prompts en cache ; l’écriture les stocke et peut coûter plus cher. Les tokens de sortie utilisent le prix de sortie.
Génération showcase de modèles
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#206 Mercury 2.5
medium- Coût
- $0.001
- Temps
- 3.8s
- Tokens
- 3,386 tok
#200 Laguna XS 2.1
medium- Coût
- $0.001
- Temps
- 30.6s
- Tokens
- 4,678 tok
Meilleurs modèles par score
Score vs coût total
Temps de réponse (moy.)
Score vs Temps de réponse (moy.)
Total des jetons de sortie
Score vs Total des jetons de sortie
Répartition par catégorie
| Tâches agentiques | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| Mercury 2.5 | 4.7 | 3.1 | 33.3% | 1 | 107.89s | 226,580 | 780 | 18,037 | |
| Laguna XS 2.1 | 6.1 | 3.1 | 66.7% | 1 | 66.42s | 233,518 | 3,036 | 12,776 |
| Astuces anti-IA | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| Mercury 2.5 | 10.0 | 10.0 | 100.0% | 0 | 1.28s | 773 | 192 | 7,122 | |
| Laguna XS 2.1 | 4.8 | 10.0 | 25.0% | 0 | 41.96s | 774 | 353 | 73,090 |
| Programmation | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| Mercury 2.5 | 5.0 | 5.1 | 44.5% | 2 | 3.70s | 7,807 | 488 | 21,857 | |
| Laguna XS 2.1 | 5.5 | 10.0 | 33.3% | 0 | 70.35s | 7,995 | 23,767 | 83,258 |
| Combiné | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| Mercury 2.5 | 6.5 | 10.0 | 50.0% | 0 | 9.23s | 62,336 | 1,073 | 34,370 | |
| Laguna XS 2.1 | 6.3 | 10.0 | 50.0% | 0 | 218.07s | 91,698 | 5,496 | 229,064 |
| Analyse et extraction des données | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| Mercury 2.5 | 10.0 | 10.0 | 100.0% | 0 | 2.57s | 8,385 | 582 | 9,343 | |
| Laguna XS 2.1 | 10.0 | 10.0 | 100.0% | 0 | 4.50s | 7,734 | 234 | 3,129 |
| Spécifique au domaine | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| Mercury 2.5 | 3.6 | 7.2 | 22.2% | 1 | 4.39s | 852 | 59 | 19,837 | |
| Laguna XS 2.1 | 3.5 | 4.4 | 33.3% | 2 | 67.48s | 843 | 17 | 91,430 |
| Intelligence générale | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| Mercury 2.5 | 4.4 | 9.9 | 0.0% | 0 | 1.60s | 528 | 98 | 2,364 | |
| Laguna XS 2.1 | 5.0 | 10.0 | 0.0% | 0 | 4.15s | 537 | 119 | 1,375 |
| Suivi des instructions | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| Mercury 2.5 | 6.4 | 6.0 | 66.7% | 1 | 1.07s | 520 | 55 | 2,344 | |
| Laguna XS 2.1 | 9.8 | 10.0 | 100.0% | 0 | 2.57s | 753 | 82 | 1,844 |
| Résolution d'énigmes | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| Mercury 2.5 | 10.0 | 10.0 | 100.0% | 0 | 1.93s | 766 | 290 | 7,721 | |
| Laguna XS 2.1 | 5.3 | 10.0 | 33.3% | 0 | 3.43s | 771 | 357 | 3,355 |
| Appel d'outils | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| Mercury 2.5 | 10.0 | 10.0 | 100.0% | 0 | 3.35s | 9,203 | 269 | 4,641 | |
| Laguna XS 2.1 | 10.0 | 10.0 | 100.0% | 0 | 3.01s | 7,638 | 309 | 748 |
| Culture générale | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| Mercury 2.5 | 3.0 | 10.0 | 0.0% | 0 | 4.30s | 232 | 32 | 7,392 | |
| Laguna XS 2.1 | 3.0 | 10.0 | 0.0% | 0 | 10.88s | 255 | 16 | 4,437 |
Comparaison rapide
Changer la paire de comparaison
Gemini 3.5 FlashminimalvsMercury 2.5mediumLaguna XS 2.1mediumDisponible gratuitementvsQwen3.5-122B-A10BnoneKAT-Coder-Pro V2.5highvsLaguna XS 2.1mediumDisponible gratuitementDots 3 Note PreviewhighDisponible gratuitementvsMercury 2.5mediumDots 3 Note PreviewlowDisponible gratuitementvsMercury 2.5mediumGemini 3 Flash PreviewnonevsLaguna XS 2.1mediumDisponible gratuitementLaguna XS 2.1mediumDisponible gratuitementvsGLM 5.1noneLaguna XS 2.1mediumDisponible gratuitementvsGLM 5.3lowMercury 2.5mediumvsLongCat 2.0noneMercury 2.5highvsLaguna XS 2.1mediumDisponible gratuitementMercury 2.5mediumvsQwen3.6 27BnoneMercury 2.5 PreviewhighvsLaguna XS 2.1mediumDisponible gratuitement