- Rang
- #300
- Total des jetons de sortie
- 3,627
- Temps de réponse (moy.)
- 4.16s
- Coût total
- $0.024
GPT-4o-mini vs Laguna S 2.1 (medium)
Laguna S 2.1 (medium) mène au score moyen avec 5.0 vs 5.0. GPT-4o-mini a le coût de benchmark le plus bas avec $0.024 vs $0.080. GPT-4o-mini est plus rapide avec 4.16s vs 63.06s, avec des taux de réussite de 21.7% vs 24.6%.
Modèles comparés
- Rang
- #296
- Total des jetons de sortie
- 386,824
- Temps de réponse (moy.)
- 63.06s
- Coût total
- $0.080
Modèle recommandé
GPT-4o-mini
Son score reste proche du meilleur score ici (5.0 vs 5.0) tout en coûtant environ 3.3x moins que Laguna S 2.1 (medium).
Comparaison détaillée
| Métrique | GPT-4o-mini GPT-4o-mini none | Laguna S 2.1 Laguna S 2.1 medium Disponible gratuitement |
|---|---|---|
| Score | 5.0 | 5.0 |
| Rang | #300 | #296 |
| Fiabilité | 10.0 | 10.0 |
| Cohérence | 9.9 | 8.5 |
| Tentatives | 69/69 | 69/69 |
| Tests corrects | ||
| Taux de réussite par tentative | 21.7% | 24.6% |
| Tests instables | 0 | 4 |
| Exécutions totales | 69 | 69 |
| Coût par résultat | 0.480 | 1.987 |
| Coût total | $0.024 | $0.080 |
| Prix d'entrée | $0.150 / 1M | $0.090 / 1M |
| Prix de sortie | $0.600 / 1M | $0.180 / 1M |
| Total des jetons d'entrée | 145,180 | 230,291 |
| Jetons de sortie | 3,627 | 99,030 |
| Jetons de raisonnement | 0 | 287,794 |
| Temps de réponse (moy.) | 4.16s | 63.06s |
| Temps de réponse (max) | 39.99s | 560.31s |
| Temps de réponse (total) | 70.70s | 1450.31s |
| Paramètres | ~8B | 118B au total (8B actifs) |
| Disponibilité | Source fermée | Poids disponibles |
Génération showcase de modèles
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#300 GPT-4o-mini
none- Coût
- $0.001
- Temps
- 6.6s
- Tokens
- 742 tok
#296 Laguna S 2.1
medium- Coût
- $0.001
- Temps
- 4.0s
- Tokens
- 867 tok
Meilleurs modèles par score
Score vs coût total
Temps de réponse (moy.)
Score vs Temps de réponse (moy.)
Total des jetons de sortie
Score vs Total des jetons de sortie
Répartition par catégorie
| Tâches agentiques | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| GPT-4o-mini | 5.0 | 10.0 | 0.0% | 0 | 39.99s | 92,035 | 714 | 0 | |
| Laguna S 2.1 | 3.4 | 2.2 | 33.3% | 1 | 165.05s | 143,644 | 1,732 | 45,497 |
| Astuces anti-IA | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| GPT-4o-mini | 4.8 | 10.0 | 25.0% | 0 | 1.34s | 618 | 186 | 0 | |
| Laguna S 2.1 | 3.4 | 5.8 | 25.0% | 2 | 51.82s | 672 | 370 | 45,172 |
| Programmation | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| GPT-4o-mini | 3.2 | 9.6 | 0.0% | 0 | 1.63s | 7,314 | 367 | 0 | |
| Laguna S 2.1 | 5.3 | 7.2 | 44.4% | 1 | 158.98s | 7,917 | 93,354 | 106,718 |
| Combiné | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| GPT-4o-mini | 3.0 | 10.0 | 0.0% | 0 | 6.32s | 29,916 | 1,497 | 0 | |
| Laguna S 2.1 | 3.2 | 9.1 | 0.0% | 0 | 284.71s | 60,785 | 2,413 | 80,089 |
| Analyse et extraction des données | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| GPT-4o-mini | 10.0 | 10.0 | 100.0% | 0 | 1.27s | 7,161 | 183 | 0 | |
| Laguna S 2.1 | 10.0 | 10.0 | 100.0% | 0 | 2.42s | 7,689 | 243 | 1,699 |
| Spécifique au domaine | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| GPT-4o-mini | 3.0 | 10.0 | 0.0% | 0 | 743ms | 741 | 17 | 0 | |
| Laguna S 2.1 | 3.0 | 10.0 | 0.0% | 0 | 2.68s | 771 | 24 | 2,863 |
| Intelligence générale | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| GPT-4o-mini | 4.0 | 10.0 | 0.0% | 0 | 909ms | 480 | 66 | 0 | |
| Laguna S 2.1 | 4.6 | 9.8 | 0.0% | 0 | 739ms | 513 | 164 | 0 |
| Suivi des instructions | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| GPT-4o-mini | 6.3 | 10.0 | 50.0% | 0 | 1.11s | 666 | 69 | 0 | |
| Laguna S 2.1 | 4.2 | 9.9 | 0.0% | 0 | 400ms | 702 | 57 | 0 |
| Résolution d'énigmes | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| GPT-4o-mini | 3.5 | 10.0 | 0.0% | 0 | 1.21s | 651 | 308 | 0 | |
| Laguna S 2.1 | 3.1 | 10.0 | 0.0% | 0 | 2.62s | 699 | 375 | 2,497 |
| Appel d'outils | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| GPT-4o-mini | 10.0 | 10.0 | 100.0% | 0 | 2.51s | 5,400 | 205 | 0 | |
| Laguna S 2.1 | 10.0 | 10.0 | 100.0% | 0 | 2.24s | 6,747 | 270 | 420 |
| Culture générale | Score | Cohérence | Taux de réussite par tentative | Tests instables | Tests corrects | Temps de réponse (moy.) | Jetons d'entrée | Jetons de sortie | Jetons de raisonnement |
|---|---|---|---|---|---|---|---|---|---|
| GPT-4o-mini | 3.0 | 10.0 | 0.0% | 0 | 794ms | 198 | 15 | 0 | |
| Laguna S 2.1 | 3.0 | 10.0 | 0.0% | 0 | 7.11s | 152 | 28 | 2,839 |
Comparaison rapide
Changer la paire de comparaison
KAT Coder AIR V2.5lowvsGPT-4o-mininoneMiniMax M2.7mediumvsGPT-4o-mininoneMercury 2.5 PreviewlowvsLaguna S 2.1mediumDisponible gratuitementMercury 2.5 PreviewlowvsGPT-4o-mininoneLaguna S 2.1mediumDisponible gratuitementvsMiMo-V2.5-PrononeMercury 2.5lowvsLaguna S 2.1mediumDisponible gratuitementDots 3 Note PreviewnoneDisponible gratuitementvsLaguna S 2.1mediumDisponible gratuitementGPT-4o-mininonevsLaguna S 2.1highDisponible gratuitementMistral Small 4nonevsLaguna S 2.1mediumDisponible gratuitementKAT Coder AIR V2.5lowvsLaguna S 2.1mediumDisponible gratuitementKAT Coder AIR V2.5highvsLaguna S 2.1mediumDisponible gratuitementLaguna S 2.1mediumDisponible gratuitementvsInkling SmallnoneDisponible gratuitement