- Rang
- #288
- Total des jetons de sortie
- 114,654
- Temps de réponse (moy.)
- 15.23s
- Coût total
- $0.077
KAT Coder AIR V2.5 (high) vs Laguna S 2.1 (medium)
KAT Coder AIR V2.5 (high) mène au score moyen avec 5.2 vs 5.0. KAT Coder AIR V2.5 (high) a le coût de benchmark le plus bas avec $0.077 vs $0.080. KAT Coder AIR V2.5 (high) est plus rapide avec 15.23s vs 63.06s, avec des taux de réussite de 40.6% vs 24.6%.
Modèles comparés
- Rang
- #296
- Total des jetons de sortie
- 386,824
- Temps de réponse (moy.)
- 63.06s
- Coût total
- $0.080
Modèle recommandé
KAT Coder AIR V2.5 (high)
Il obtient le meilleur score ici (5.2) et répond environ 4.1x plus vite que Laguna S 2.1 (medium).
Comparaison détaillée
| Métrique | KAT Coder AIR V2.5 KAT Coder AIR V2.5 high | Laguna S 2.1 Laguna S 2.1 medium Disponible gratuitement |
|---|---|---|
| Score | 5.2 | 5.0 |
| Rang | #288 | #296 |
| Fiabilité | 9.8 | 10.0 |
| Cohérence | 8.2 | 8.5 |
| Tentatives | 69/69 | 69/69 |
| Tests corrects | ||
| Taux de réussite par tentative | 40.6% | 24.6% |
| Tests instables | 5 | 4 |
| Exécutions totales | 69 | 69 |
| Coût par résultat | 1.091 | 1.987 |
| Coût total | $0.077 | $0.080 |
| Prix d'entrée | $0.000 / 1M | $0.090 / 1M |
| Prix de sortie | $0.000 / 1M | $0.180 / 1M |
| Total des jetons d'entrée | 50,423 | 230,291 |
| Jetons de sortie | 4,144 | 99,030 |
| Jetons de raisonnement | 110,510 | 287,794 |
| Temps de réponse (moy.) | 15.23s | 63.06s |
| Temps de réponse (max) | 118.35s | 560.31s |
| Temps de réponse (total) | 350.26s | 1450.31s |
| Paramètres | ~35B au total (~3B actifs) | 118B au total (8B actifs) |
| Disponibilité | Source fermée | Poids disponibles |
Génération showcase de modèles
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#288 KAT Coder AIR V2.5
high
Reached the allocated time limit (300 seconds) without receiving showcase output.
- Coût
- $0.000
- Temps
- 300.0s
- Tokens
- 0 tok
#296 Laguna S 2.1
medium- Coût
- $0.001
- Temps
- 4.0s
- Tokens
- 867 tok
Meilleurs modèles par score
Score vs coût total
Temps de réponse (moy.)
Score vs Temps de réponse (moy.)
Total des jetons de sortie
Score vs Total des jetons de sortie
Répartition par catégorie
| Tâches agentiques | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 3.0 | 10.0 | 0.0% | 0 | 1.10s | 0 | 0 | 0 | |
| Laguna S 2.1 | 3.4 | 2.2 | 33.3% | 1 | 165.05s | 143,644 | 1,732 | 45,497 |
| Astuces anti-IA | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 6.9 | 5.8 | 75.0% | 2 | 2.49s | 615 | 204 | 1,290 | |
| Laguna S 2.1 | 3.4 | 5.8 | 25.0% | 2 | 51.82s | 672 | 370 | 45,172 |
| Programmation | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 4.3 | 7.3 | 11.1% | 1 | 39.07s | 6,948 | 1,166 | 55,883 | |
| Laguna S 2.1 | 5.3 | 7.2 | 44.4% | 1 | 158.98s | 7,917 | 93,354 | 106,718 |
| Combiné | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 6.5 | 10.0 | 50.0% | 0 | 74.48s | 23,854 | 485 | 28,559 | |
| Laguna S 2.1 | 3.2 | 9.1 | 0.0% | 0 | 284.71s | 60,785 | 2,413 | 80,089 |
| Analyse et extraction des données | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 6.5 | 10.0 | 50.0% | 0 | 3.59s | 7,776 | 284 | 2,140 | |
| Laguna S 2.1 | 10.0 | 10.0 | 100.0% | 0 | 2.42s | 7,689 | 243 | 1,699 |
| Spécifique au domaine | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 3.0 | 10.0 | 0.0% | 0 | 7.28s | 724 | 1,101 | 7,738 | |
| Laguna S 2.1 | 3.0 | 10.0 | 0.0% | 0 | 2.68s | 771 | 24 | 2,863 |
| Intelligence générale | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 5.1 | 10.0 | 0.0% | 0 | 7.10s | 516 | 179 | 539 | |
| Laguna S 2.1 | 4.6 | 9.8 | 0.0% | 0 | 739ms | 513 | 164 | 0 |
| Suivi des instructions | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 9.8 | 10.0 | 100.0% | 0 | 1.51s | 699 | 90 | 675 | |
| Laguna S 2.1 | 4.2 | 9.9 | 0.0% | 0 | 400ms | 702 | 57 | 0 |
| Résolution d'énigmes | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 3.5 | 4.4 | 33.3% | 2 | 2.47s | 696 | 285 | 1,576 | |
| Laguna S 2.1 | 3.1 | 10.0 | 0.0% | 0 | 2.62s | 699 | 375 | 2,497 |
| Appel d'outils | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 10.0 | 10.0 | 100.0% | 0 | 4.77s | 8,391 | 330 | 1,082 | |
| Laguna S 2.1 | 10.0 | 10.0 | 100.0% | 0 | 2.24s | 6,747 | 270 | 420 |
| Culture générale | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 3.0 | 10.0 | 0.0% | 0 | 21.72s | 204 | 20 | 11,028 | |
| Laguna S 2.1 | 3.0 | 10.0 | 0.0% | 0 | 7.11s | 152 | 28 | 2,839 |
Comparaison rapide
Changer la paire de comparaison
Mercury 2.5 PreviewlowvsLaguna S 2.1mediumDisponible gratuitementLing 3.0 FlashnonevsKAT Coder AIR V2.5highKAT Coder AIR V2.5highvsInkling SmalllowDisponible gratuitementKAT Coder AIR V2.5highvsMistral Small 4mediumKAT Coder AIR V2.5highvsMistral Small 4noneLaguna S 2.1mediumDisponible gratuitementvsMiMo-V2.5-PrononeMercury 2.5lowvsLaguna S 2.1mediumDisponible gratuitementMercury 2.5lowvsKAT Coder AIR V2.5highKAT Coder AIR V2.5highvsMiMo-V2.5-PrononeDots 3 Note PreviewnoneDisponible gratuitementvsLaguna S 2.1mediumDisponible gratuitementGPT-4o-mininonevsLaguna S 2.1mediumDisponible gratuitementMistral Small 4nonevsLaguna S 2.1mediumDisponible gratuitement