- Rang
- #304
- Total des jetons de sortie
- 386,824
- Temps de réponse (moy.)
- 63.06s
- Coût total
- $0.092
Laguna S 2.1 (medium) vs Qwen3.5-9B
Laguna S 2.1 (medium) mène au score moyen avec 5.0 vs 4.9. Qwen3.5-9B a le coût de benchmark le plus bas avec $0.041 vs $0.092. Qwen3.5-9B est plus rapide avec 37.19s vs 63.06s, avec des taux de réussite de 24.6% vs 18.8%.
Modèles comparés
- Rang
- #317
- Total des jetons de sortie
- 70,427
- Temps de réponse (moy.)
- 37.19s
- Coût total
- $0.041
Modèle recommandé
Qwen3.5-9B
Son score reste proche du meilleur score ici (4.9 vs 5.0) tout en coûtant environ 2.2x moins que Laguna S 2.1 (medium).
Comparaison détaillée
| Métrique | Laguna S 2.1 Laguna S 2.1 medium Disponible gratuitement | Qwen3.5-9B Qwen3.5-9B none |
|---|---|---|
| Score | 5.0 | 4.9 |
| Rang | #304 | #317 |
| Fiabilité | 10.0 | 9.8 |
| Cohérence | 8.5 | 9.7 |
| Tentatives | 69/69 | 69/69 |
| Tests corrects | ||
| Taux de réussite par tentative | 24.6% | 18.8% |
| Tests instables | 4 | 1 |
| Exécutions totales | 69 | 69 |
| Coût par résultat | 1.987 | 1.022 |
| Coût total | $0.092 | $0.041 |
| Prix d'entrée | $0.090 / 1M | $0.100 / 1M |
| Prix de sortie | $0.180 / 1M | $0.150 / 1M |
| Prix de lecture du cache | $0.009 / 1M | N/D |
| Prix d’écriture du cache | N/D | N/D |
| Total des jetons d'entrée | 230,291 | 307,670 |
| Jetons de sortie | 99,030 | 70,427 |
| Jetons de raisonnement | 287,794 | 0 |
| Temps de réponse (moy.) | 63.06s | 37.19s |
| Temps de réponse (max) | 560.31s | 433.02s |
| Temps de réponse (total) | 1450.31s | 855.27s |
| Paramètres | 118B au total (8B actifs) | 9B |
| Disponibilité | Poids disponibles | Open source |
Les prix du cache concernent les tokens d’entrée. La lecture réutilise les prompts en cache ; l’écriture les stocke et peut coûter plus cher. Les tokens de sortie utilisent le prix de sortie.
Génération showcase de modèles
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#304 Laguna S 2.1
medium- Coût
- $0.001
- Temps
- 4.0s
- Tokens
- 867 tok
#317 Qwen3.5-9B
none
Reached the allocated time limit (300 seconds) without receiving showcase output.
- Coût
- $0.000
- Temps
- 300.0s
- Tokens
- 0 tok
Meilleurs modèles par score
Score vs coût total
Temps de réponse (moy.)
Score vs Temps de réponse (moy.)
Total des jetons de sortie
Score vs Total des jetons de sortie
Répartition par catégorie
| Tâches agentiques | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| Laguna S 2.1 | 3.4 | 2.2 | 33.3% | 1 | 165.05s | 143,644 | 1,732 | 45,497 | |
| Qwen3.5-9B | 3.9 | 9.6 | 0.0% | 0 | 433.02s | 163,254 | 32,943 | 0 |
| Astuces anti-IA | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| Laguna S 2.1 | 3.4 | 5.8 | 25.0% | 2 | 51.82s | 672 | 370 | 45,172 | |
| Qwen3.5-9B | 3.1 | 9.9 | 0.0% | 0 | 1.71s | 696 | 582 | 0 |
| Programmation | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| Laguna S 2.1 | 5.3 | 7.2 | 44.4% | 1 | 158.98s | 7,917 | 93,354 | 106,718 | |
| Qwen3.5-9B | 3.9 | 7.8 | 11.1% | 1 | 5.60s | 7,913 | 1,042 | 0 |
| Combiné | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| Laguna S 2.1 | 3.2 | 9.1 | 0.0% | 0 | 284.71s | 60,785 | 2,413 | 80,089 | |
| Qwen3.5-9B | 3.0 | 10.0 | 0.0% | 0 | 193.98s | 116,763 | 34,787 | 0 |
| Analyse et extraction des données | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| Laguna S 2.1 | 10.0 | 10.0 | 100.0% | 0 | 2.42s | 7,689 | 243 | 1,699 | |
| Qwen3.5-9B | 10.0 | 10.0 | 100.0% | 0 | 847ms | 7,788 | 249 | 0 |
| Spécifique au domaine | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| Laguna S 2.1 | 3.0 | 10.0 | 0.0% | 0 | 2.68s | 771 | 24 | 2,863 | |
| Qwen3.5-9B | 3.0 | 10.0 | 0.0% | 0 | 636ms | 798 | 24 | 0 |
| Intelligence générale | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| Laguna S 2.1 | 4.6 | 9.8 | 0.0% | 0 | 739ms | 513 | 164 | 0 | |
| Qwen3.5-9B | 4.4 | 9.9 | 0.0% | 0 | 552ms | 522 | 99 | 0 |
| Suivi des instructions | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| Laguna S 2.1 | 4.2 | 9.9 | 0.0% | 0 | 400ms | 702 | 57 | 0 | |
| Qwen3.5-9B | 6.5 | 10.0 | 50.0% | 0 | 514ms | 711 | 75 | 0 |
| Résolution d'énigmes | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| Laguna S 2.1 | 3.1 | 10.0 | 0.0% | 0 | 2.62s | 699 | 375 | 2,497 | |
| Qwen3.5-9B | 3.2 | 10.0 | 0.0% | 0 | 621ms | 714 | 347 | 0 |
| Appel d'outils | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| Laguna S 2.1 | 10.0 | 10.0 | 100.0% | 0 | 2.24s | 6,747 | 270 | 420 | |
| Qwen3.5-9B | 10.0 | 10.0 | 100.0% | 0 | 1.27s | 8,301 | 273 | 0 |
| Culture générale | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| Laguna S 2.1 | 3.0 | 10.0 | 0.0% | 0 | 7.11s | 152 | 28 | 2,839 | |
| Qwen3.5-9B | 3.0 | 10.0 | 0.0% | 0 | 2.32s | 210 | 6 | 0 |
Comparaison rapide
Changer la paire de comparaison
Mercury 2.5 PreviewlowvsLaguna S 2.1mediumDisponible gratuitementLaguna S 2.1highDisponible gratuitementvsQwen3.5-9BnoneApodex 1.1 MininoneDisponible gratuitementvsLaguna S 2.1mediumDisponible gratuitementLaguna S 2.1mediumDisponible gratuitementvsMiMo-V2.5-PrononeMercury 2.5lowvsLaguna S 2.1mediumDisponible gratuitementDots 3 Note PreviewnoneDisponible gratuitementvsLaguna S 2.1mediumDisponible gratuitementGPT-4o-mininonevsLaguna S 2.1mediumDisponible gratuitementMistral Small 4nonevsLaguna S 2.1mediumDisponible gratuitementKAT Coder AIR V2.5lowvsLaguna S 2.1mediumDisponible gratuitementKAT Coder AIR V2.5lowvsQwen3.5-9BnoneMiniMax M2.7mediumvsQwen3.5-9BnoneKAT Coder AIR V2.5highvsLaguna S 2.1mediumDisponible gratuitement