- Rang
- #300
- Total tokenuri de ieșire
- 3,627
- Timp de răspuns (mediu)
- 4.16s
- Cost total
- $0.024
GPT-4o-mini vs Laguna S 2.1 (high)
GPT-4o-mini conduce la scorul mediu cu 5.0 vs 4.9. GPT-4o-mini are costul de benchmark mai mic, $0.024 vs $0.147. GPT-4o-mini este mai rapid cu 4.16s vs 113.63s, cu rate de reușită de 21.7% vs 27.5%.
Modele comparate
- Rang
- #305
- Total tokenuri de ieșire
- 630,543
- Timp de răspuns (mediu)
- 113.63s
- Cost total
- $0.147
Model recomandat
GPT-4o-mini
Are cel mai bun scor aici (5.0) și costă de aproximativ 6.1x mai puțin decât Laguna S 2.1 (high).
Comparație detaliată
| Metrică | GPT-4o-mini GPT-4o-mini none | Laguna S 2.1 Laguna S 2.1 high Disponibil gratuit |
|---|---|---|
| Scor | 5.0 | 4.9 |
| Rang | #300 | #305 |
| Fiabilitate | 10.0 | 10.0 |
| Consistență | 9.9 | 7.8 |
| Încercări | 69/69 | 69/69 |
| Teste corecte | ||
| Rată de trecere pe încercare | 21.7% | 27.5% |
| Teste instabile | 0 | 6 |
| Rulări totale | 69 | 69 |
| Cost per rezultat | 0.480 | 3.664 |
| Cost total | $0.024 | $0.147 |
| Preț de intrare | $0.150 / 1M | $0.090 / 1M |
| Preț de ieșire | $0.600 / 1M | $0.180 / 1M |
| Total tokenuri de intrare | 145,180 | 344,806 |
| Tokenuri de ieșire | 3,627 | 177,330 |
| Tokenuri de raționament | 0 | 453,213 |
| Timp de răspuns (mediu) | 4.16s | 113.63s |
| Timp de răspuns (maxim) | 39.99s | 1190.11s |
| Timp de răspuns (total) | 70.70s | 2613.48s |
| Parametri | ~8B | 118B în total (8B activi) |
| Disponibilitate | Închis | Ponderi disponibile |
Prezentare generare modele
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#300 GPT-4o-mini
none- Cost
- $0.001
- Timp
- 6.6s
- Tokenuri
- 742 tok
#305 Laguna S 2.1
high- Cost
- $0.001
- Timp
- 6.8s
- Tokenuri
- 1,389 tok
Top modele după scor
Scor vs cost total
Timp de răspuns (mediu)
Scor vs Timp de răspuns (mediu)
Total tokenuri de ieșire
Scor vs Total tokenuri de ieșire
Defalcare pe categorii
| Sarcini agentice | Scor | Consistență | Rată de trecere pe încercare | Teste instabile | Teste corecte | Timp de răspuns (mediu) | Tokenuri de intrare | Tokenuri de ieșire | Tokenuri de raționament |
|---|---|---|---|---|---|---|---|---|---|
| GPT-4o-mini | 5.0 | 10.0 | 0.0% | 0 | 39.99s | 92,035 | 714 | 0 | |
| Laguna S 2.1 | 2.8 | 1.6 | 33.3% | 1 | 158.25s | 135,869 | 1,742 | 43,937 |
| Trucuri anti-AI | Scor | Consistență | Rată de trecere pe încercare | Teste instabile | Teste corecte | Timp de răspuns (mediu) | Tokenuri de intrare | Tokenuri de ieșire | Tokenuri de raționament |
|---|---|---|---|---|---|---|---|---|---|
| GPT-4o-mini | 4.8 | 10.0 | 25.0% | 0 | 1.34s | 618 | 186 | 0 | |
| Laguna S 2.1 | 3.4 | 5.8 | 25.0% | 2 | 52.20s | 672 | 504 | 46,579 |
| Programare | Scor | Consistență | Rată de trecere pe încercare | Teste instabile | Teste corecte | Timp de răspuns (mediu) | Tokenuri de intrare | Tokenuri de ieșire | Tokenuri de raționament |
|---|---|---|---|---|---|---|---|---|---|
| GPT-4o-mini | 3.2 | 9.6 | 0.0% | 0 | 1.63s | 7,314 | 367 | 0 | |
| Laguna S 2.1 | 5.3 | 7.2 | 44.4% | 1 | 271.42s | 6,496 | 59,355 | 151,009 |
| Combinat | Scor | Consistență | Rată de trecere pe încercare | Teste instabile | Teste corecte | Timp de răspuns (mediu) | Tokenuri de intrare | Tokenuri de ieșire | Tokenuri de raționament |
|---|---|---|---|---|---|---|---|---|---|
| GPT-4o-mini | 3.0 | 10.0 | 0.0% | 0 | 6.32s | 29,916 | 1,497 | 0 | |
| Laguna S 2.1 | 2.9 | 6.0 | 16.7% | 1 | 702.26s | 184,420 | 114,577 | 203,826 |
| Parsare și extragere de date | Scor | Consistență | Rată de trecere pe încercare | Teste instabile | Teste corecte | Timp de răspuns (mediu) | Tokenuri de intrare | Tokenuri de ieșire | Tokenuri de raționament |
|---|---|---|---|---|---|---|---|---|---|
| GPT-4o-mini | 10.0 | 10.0 | 100.0% | 0 | 1.27s | 7,161 | 183 | 0 | |
| Laguna S 2.1 | 10.0 | 10.0 | 100.0% | 0 | 1.96s | 7,689 | 243 | 1,705 |
| Specific domeniului | Scor | Consistență | Rată de trecere pe încercare | Teste instabile | Teste corecte | Timp de răspuns (mediu) | Tokenuri de intrare | Tokenuri de ieșire | Tokenuri de raționament |
|---|---|---|---|---|---|---|---|---|---|
| GPT-4o-mini | 3.0 | 10.0 | 0.0% | 0 | 743ms | 741 | 17 | 0 | |
| Laguna S 2.1 | 3.0 | 10.0 | 0.0% | 0 | 2.51s | 771 | 24 | 2,035 |
| Inteligență generală | Scor | Consistență | Rată de trecere pe încercare | Teste instabile | Teste corecte | Timp de răspuns (mediu) | Tokenuri de intrare | Tokenuri de ieșire | Tokenuri de raționament |
|---|---|---|---|---|---|---|---|---|---|
| GPT-4o-mini | 4.0 | 10.0 | 0.0% | 0 | 909ms | 480 | 66 | 0 | |
| Laguna S 2.1 | 4.6 | 9.8 | 0.0% | 0 | 855ms | 513 | 135 | 0 |
| Respectarea instrucțiunilor | Scor | Consistență | Rată de trecere pe încercare | Teste instabile | Teste corecte | Timp de răspuns (mediu) | Tokenuri de intrare | Tokenuri de ieșire | Tokenuri de raționament |
|---|---|---|---|---|---|---|---|---|---|
| GPT-4o-mini | 6.3 | 10.0 | 50.0% | 0 | 1.11s | 666 | 69 | 0 | |
| Laguna S 2.1 | 4.6 | 10.0 | 0.0% | 0 | 453ms | 702 | 60 | 0 |
| Rezolvare de puzzle-uri | Scor | Consistență | Rată de trecere pe încercare | Teste instabile | Teste corecte | Timp de răspuns (mediu) | Tokenuri de intrare | Tokenuri de ieșire | Tokenuri de raționament |
|---|---|---|---|---|---|---|---|---|---|
| GPT-4o-mini | 3.5 | 10.0 | 0.0% | 0 | 1.21s | 651 | 308 | 0 | |
| Laguna S 2.1 | 2.9 | 7.2 | 11.1% | 1 | 1.62s | 699 | 370 | 1,130 |
| Apelare instrumente | Scor | Consistență | Rată de trecere pe încercare | Teste instabile | Teste corecte | Timp de răspuns (mediu) | Tokenuri de intrare | Tokenuri de ieșire | Tokenuri de raționament |
|---|---|---|---|---|---|---|---|---|---|
| GPT-4o-mini | 10.0 | 10.0 | 100.0% | 0 | 2.51s | 5,400 | 205 | 0 | |
| Laguna S 2.1 | 10.0 | 10.0 | 100.0% | 0 | 2.69s | 6,747 | 306 | 334 |
| Cultură generală | Scor | Consistență | Rată de trecere pe încercare | Teste instabile | Teste corecte | Timp de răspuns (mediu) | Tokenuri de intrare | Tokenuri de ieșire | Tokenuri de raționament |
|---|---|---|---|---|---|---|---|---|---|
| GPT-4o-mini | 3.0 | 10.0 | 0.0% | 0 | 794ms | 198 | 15 | 0 | |
| Laguna S 2.1 | 3.0 | 10.0 | 0.0% | 0 | 6.94s | 228 | 14 | 2,658 |
Comparație rapidă
Schimbă perechea de comparație
KAT Coder AIR V2.5lowvsGPT-4o-mininoneLaguna S 2.1highDisponibil gratuitvsQwen3 Coder NextnoneMiniMax M2.7mediumvsGPT-4o-mininoneLing 2.6 1tnonevsLaguna S 2.1highDisponibil gratuitLaguna S 2.1highDisponibil gratuitvsMiMo-V2.5noneLaguna S 2.1highDisponibil gratuitvsInkling SmallnoneDisponibil gratuitLaguna S 2.1highDisponibil gratuitvsQwen3.5-9BnoneLaguna S 2.1highDisponibil gratuitvsHy4 previewnoneMercury 2.5 PreviewlowvsGPT-4o-mininoneKAT Coder AIR V2.5lowvsLaguna S 2.1highDisponibil gratuitGPT-4o-mininonevsLaguna S 2.1mediumDisponibil gratuitDots 3 Note PreviewnoneDisponibil gratuitvsLaguna S 2.1highDisponibil gratuit