- Rang
- #119
- Total tokenuri de ieșire
- 714,287
- Timp de răspuns (mediu)
- 300.15s
- Cost total
- $1.648
Mistral Large 4 (low) vs GPT-6 Luna (low)
Scorul mediu este practic egal la 7.6 vs 7.6. GPT-6 Luna (low) are costul de benchmark mai mic, $0.033 vs $1.648. GPT-6 Luna (low) este mai rapid cu 23.23s vs 300.15s, cu rate de reușită de 65.2% vs 63.8%.
Modele comparate
- Rang
- #121
- Total tokenuri de ieșire
- 24,880
- Timp de răspuns (mediu)
- 23.23s
- Cost total
- $0.033
Model recomandat
GPT-6 Luna (low)
Are cel mai bun scor aici (7.6) și costă de aproximativ 51.4x mai puțin decât Mistral Large 4 (low).
Comparație detaliată
| Metrică | Mistral Large 4 Mistral Large 4 low | GPT-6 Luna GPT-6 Luna low |
|---|---|---|
| Scor | 7.6 | 7.6 |
| Rang | #119 | #121 |
| Fiabilitate | 9.0 | 9.7 |
| Consistență | 8.7 | 8.5 |
| Încercări | 69/69 | 69/69 |
| Teste corecte | ||
| Rată de trecere pe încercare | 65.2% | 63.8% |
| Teste instabile | 4 | 4 |
| Rulări totale | 69 | 69 |
| Cost per rezultat | 12.670 | 0.267 |
| Cost total | $1.648 | $0.033 |
| Preț de intrare | $0.680 / 1M | $0.100 / 1M |
| Preț de ieșire | $2.090 / 1M | $0.500 / 1M |
| Preț citire cache | $0.070 / 1M | $0.010 / 1M |
| Preț scriere cache | N/D | $0.125 / 1M |
| Total tokenuri de intrare | 226,734 | 195,928 |
| Tokenuri de ieșire | 278,013 | 5,728 |
| Tokenuri de raționament | 638,296 | 19,152 |
| Timp de răspuns (mediu) | 300.15s | 23.23s |
| Timp de răspuns (maxim) | 1798.01s | 89.37s |
| Timp de răspuns (total) | 6903.40s | 534.22s |
| Parametri | 1.05T în total (49B activi) | ~400B în total (~17B activi) |
| Disponibilitate | Închis | Închis |
Prețurile de cache se aplică tokenurilor de intrare. Citirea reutilizează prompturi salvate; scrierea le stochează și poate costa în plus. Tokenurile de ieșire folosesc prețul de ieșire.
Prezentare generare modele
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#119 Mistral Large 4
low- Cost
- $0.015
- Timp
- 115.1s
- Tokenuri
- 6,915 tok
#121 GPT-6 Luna
low- Cost
- $0.002
- Timp
- 19.2s
- Tokenuri
- 2,598 tok
Top modele după scor
Scor vs cost total
Timp de răspuns (mediu)
Scor vs Timp de răspuns (mediu)
Total tokenuri de ieșire
Scor vs Total tokenuri de ieșire
Defalcare pe categorii
| Sarcini agentice | Scor | Consistență | Rată de trecere pe încercare | Teste instabile | Teste corecte | Timp de răspuns (mediu) | Tokenuri de intrare | Tokenuri de ieșire | Tokenuri de raționament |
|---|---|---|---|---|---|---|---|---|---|
| Mistral Large 4 | 10.0 | 10.0 | 100.0% | 0 | 69.63s | 143,243 | 3,788 | 3,053 | |
| GPT-6 Luna | 10.0 | 10.0 | 100.0% | 0 | 51.03s | 115,769 | 1,105 | 1,170 |
| Trucuri anti-AI | Scor | Consistență | Rată de trecere pe încercare | Teste instabile | Teste corecte | Timp de răspuns (mediu) | Tokenuri de intrare | Tokenuri de ieșire | Tokenuri de raționament |
|---|---|---|---|---|---|---|---|---|---|
| Mistral Large 4 | 8.3 | 10.0 | 75.0% | 0 | 19.75s | 705 | 999 | 9,354 | |
| GPT-6 Luna | 6.9 | 7.9 | 66.7% | 1 | 11.00s | 554 | 130 | 704 |
| Programare | Scor | Consistență | Rată de trecere pe încercare | Teste instabile | Teste corecte | Timp de răspuns (mediu) | Tokenuri de intrare | Tokenuri de ieșire | Tokenuri de raționament |
|---|---|---|---|---|---|---|---|---|---|
| Mistral Large 4 | 3.4 | 7.2 | 22.2% | 1 | 1379.72s | 5,896 | 129,426 | 386,126 | |
| GPT-6 Luna | 6.0 | 7.2 | 55.6% | 1 | 15.39s | 7,302 | 493 | 6,655 |
| Combinat | Scor | Consistență | Rată de trecere pe încercare | Teste instabile | Teste corecte | Timp de răspuns (mediu) | Tokenuri de intrare | Tokenuri de ieșire | Tokenuri de raționament |
|---|---|---|---|---|---|---|---|---|---|
| Mistral Large 4 | 10.0 | 10.0 | 100.0% | 0 | 556.27s | 60,360 | 5,603 | 60,531 | |
| GPT-6 Luna | 7.3 | 5.8 | 83.3% | 1 | 49.77s | 57,227 | 3,023 | 2,271 |
| Parsare și extragere de date | Scor | Consistență | Rată de trecere pe încercare | Teste instabile | Teste corecte | Timp de răspuns (mediu) | Tokenuri de intrare | Tokenuri de ieșire | Tokenuri de raționament |
|---|---|---|---|---|---|---|---|---|---|
| Mistral Large 4 | 10.0 | 10.0 | 100.0% | 0 | 27.46s | 7,314 | 1,014 | 7,623 | |
| GPT-6 Luna | 10.0 | 10.0 | 100.0% | 0 | 9.94s | 7,140 | 234 | 250 |
| Specific domeniului | Scor | Consistență | Rată de trecere pe încercare | Teste instabile | Teste corecte | Timp de răspuns (mediu) | Tokenuri de intrare | Tokenuri de ieșire | Tokenuri de raționament |
|---|---|---|---|---|---|---|---|---|---|
| Mistral Large 4 | 2.9 | 7.2 | 11.1% | 1 | 291.62s | 798 | 82,605 | 111,098 | |
| GPT-6 Luna | 5.3 | 10.0 | 33.3% | 0 | 18.09s | 628 | 62 | 5,990 |
| Inteligență generală | Scor | Consistență | Rată de trecere pe încercare | Teste instabile | Teste corecte | Timp de răspuns (mediu) | Tokenuri de intrare | Tokenuri de ieșire | Tokenuri de raționament |
|---|---|---|---|---|---|---|---|---|---|
| Mistral Large 4 | 10.0 | 10.0 | 100.0% | 0 | 39.29s | 516 | 5,529 | 5,865 | |
| GPT-6 Luna | 4.4 | 9.9 | 0.0% | 0 | 1.46s | 477 | 102 | 0 |
| Respectarea instrucțiunilor | Scor | Consistență | Rată de trecere pe încercare | Teste instabile | Teste corecte | Timp de răspuns (mediu) | Tokenuri de intrare | Tokenuri de ieșire | Tokenuri de raționament |
|---|---|---|---|---|---|---|---|---|---|
| Mistral Large 4 | 8.4 | 6.9 | 83.3% | 1 | 23.21s | 708 | 5,408 | 6,402 | |
| GPT-6 Luna | 7.1 | 5.8 | 83.3% | 1 | 17.38s | 540 | 84 | 250 |
| Rezolvare de puzzle-uri | Scor | Consistență | Rată de trecere pe încercare | Teste instabile | Teste corecte | Timp de răspuns (mediu) | Tokenuri de intrare | Tokenuri de ieșire | Tokenuri de raționament |
|---|---|---|---|---|---|---|---|---|---|
| Mistral Large 4 | 7.7 | 7.3 | 77.8% | 1 | 35.82s | 717 | 8,012 | 9,030 | |
| GPT-6 Luna | 7.7 | 10.0 | 66.7% | 0 | 27.45s | 642 | 213 | 1,272 |
| Apelare instrumente | Scor | Consistență | Rată de trecere pe încercare | Teste instabile | Teste corecte | Timp de răspuns (mediu) | Tokenuri de intrare | Tokenuri de ieșire | Tokenuri de raționament |
|---|---|---|---|---|---|---|---|---|---|
| Mistral Large 4 | 10.0 | 10.0 | 100.0% | 0 | 21.53s | 6,267 | 307 | 1,015 | |
| GPT-6 Luna | 10.0 | 10.0 | 100.0% | 0 | 71.65s | 5,454 | 254 | 152 |
| Cultură generală | Scor | Consistență | Rată de trecere pe încercare | Teste instabile | Teste corecte | Timp de răspuns (mediu) | Tokenuri de intrare | Tokenuri de ieșire | Tokenuri de raționament |
|---|---|---|---|---|---|---|---|---|---|
| Mistral Large 4 | 3.0 | 10.0 | 0.0% | 0 | 358.62s | 210 | 35,322 | 38,199 | |
| GPT-6 Luna | 3.0 | 10.0 | 0.0% | 0 | 29.10s | 195 | 28 | 438 |
Comparație rapidă
Schimbă perechea de comparație
GPT-6 LunalowvsQwen3.8 Flash NextmediumGPT-6 LunalowvsSpace Bunny AlphahighMistral Large 4lowvsQwen3.8 Flash NextmediumGPT-6 LunalowvsGLM 5.1mediumSeed-2.0-MinimediumvsGPT-6 LunalowMistral Large 4lowvsSpace Bunny AlphahighMistral Large 4lowvsGLM 5.1mediumMistral Large 4highvsGPT-6 LunalowSeed-2.0-MinimediumvsMistral Large 4lowMuse Glimmer 30BmediumvsMistral Large 4lowSeed-2.0-CodehighvsGPT-6 LunalowMistral Large 4lowvsQwen3.5 Plus 2026-04-20medium