- Rang
- #79
- Total tokenuri de ieșire
- 53,161
- Timp de răspuns (mediu)
- 18.07s
- Cost total
- $0.047
GPT-6 Luna (medium) vs Qwen3 Coder Next (medium)
GPT-6 Luna (medium) conduce la scorul mediu cu 8.3 vs 4.7. GPT-6 Luna (medium) are costul de benchmark mai mic, $0.047 vs $0.071. Qwen3 Coder Next (medium) este mai rapid cu 16.97s vs 18.07s, cu rate de reușită de 73.9% vs 24.6%.
Modele comparate
- Rang
- #323
- Total tokenuri de ieșire
- 40,395
- Timp de răspuns (mediu)
- 16.97s
- Cost total
- $0.071
Model recomandat
GPT-6 Luna (medium)
Are cel mai puternic scor din această comparație (8.3) și cel mai bun echilibru între cost și timp de răspuns dintre toate cele 2 modele.
Comparație detaliată
| Metrică | GPT-6 Luna GPT-6 Luna medium | Qwen3 Coder Next Qwen3 Coder Next medium |
|---|---|---|
| Scor | 8.3 | 4.7 |
| Rang | #79 | #323 |
| Fiabilitate | 10.0 | 10.0 |
| Consistență | 8.9 | 8.7 |
| Încercări | 69/69 | 69/69 |
| Teste corecte | ||
| Rată de trecere pe încercare | 73.9% | 24.6% |
| Teste instabile | 3 | 4 |
| Rulări totale | 69 | 69 |
| Cost per rezultat | 0.313 | 2.280 |
| Cost total | $0.047 | $0.071 |
| Preț de intrare | $0.100 / 1M | $0.120 / 1M |
| Preț de ieșire | $0.500 / 1M | $0.800 / 1M |
| Preț citire cache | $0.010 / 1M | $0.070 / 1M |
| Preț scriere cache | $0.125 / 1M | N/D |
| Total tokenuri de intrare | 203,193 | 311,647 |
| Tokenuri de ieșire | 5,751 | 40,395 |
| Tokenuri de raționament | 47,410 | 0 |
| Timp de răspuns (mediu) | 18.07s | 16.97s |
| Timp de răspuns (maxim) | 66.44s | 151.35s |
| Timp de răspuns (total) | 415.53s | 305.55s |
| Parametri | ~400B în total (~17B activi) | 80B în total (3B activi) |
| Disponibilitate | Închis | Sursă deschisă |
Prețurile de cache se aplică tokenurilor de intrare. Citirea reutilizează prompturi salvate; scrierea le stochează și poate costa în plus. Tokenurile de ieșire folosesc prețul de ieșire.
Prezentare generare modele
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#79 GPT-6 Luna
medium- Cost
- $0.002
- Timp
- 23.6s
- Tokenuri
- 2,966 tok
#323 Qwen3 Coder Next
medium
Reached the allocated time limit (300 seconds) without receiving showcase output.
- Cost
- $0.000
- Timp
- 300.0s
- Tokenuri
- 0 tok
Top modele după scor
Scor vs cost total
Timp de răspuns (mediu)
Scor vs Timp de răspuns (mediu)
Total tokenuri de ieșire
Scor vs Total tokenuri de ieșire
Defalcare pe categorii
| Sarcini agentice | Scor | Consistență | Rată de trecere pe încercare | Teste instabile | Teste corecte | Timp de răspuns (mediu) | Tokenuri de intrare | Tokenuri de ieșire | Tokenuri de raționament |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna | 10.0 | 10.0 | 100.0% | 0 | 66.44s | 124,247 | 1,116 | 6,891 | |
| Qwen3 Coder Next | 5.0 | 10.0 | 0.0% | 0 | 151.35s | 163,444 | 21,326 | 0 |
| Trucuri anti-AI | Scor | Consistență | Rată de trecere pe încercare | Teste instabile | Teste corecte | Timp de răspuns (mediu) | Tokenuri de intrare | Tokenuri de ieșire | Tokenuri de raționament |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna | 8.3 | 10.0 | 75.0% | 0 | 4.32s | 606 | 156 | 875 | |
| Qwen3 Coder Next | 3.5 | 8.1 | 16.7% | 1 | 8.64s | 645 | 1,252 | 0 |
| Programare | Scor | Consistență | Rată de trecere pe încercare | Teste instabile | Teste corecte | Timp de răspuns (mediu) | Tokenuri de intrare | Tokenuri de ieșire | Tokenuri de raționament |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna | 6.6 | 4.6 | 77.8% | 2 | 23.63s | 7,302 | 438 | 10,222 | |
| Qwen3 Coder Next | 3.7 | 7.2 | 22.2% | 1 | 924ms | 7,185 | 336 | 0 |
| Combinat | Scor | Consistență | Rată de trecere pe încercare | Teste instabile | Teste corecte | Timp de răspuns (mediu) | Tokenuri de intrare | Tokenuri de ieșire | Tokenuri de raționament |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna | 10.0 | 10.0 | 100.0% | 0 | 22.65s | 55,738 | 3,052 | 4,096 | |
| Qwen3 Coder Next | 3.0 | 10.0 | 0.0% | 0 | 14.65s | 121,413 | 16,067 | 0 |
| Parsare și extragere de date | Scor | Consistență | Rată de trecere pe încercare | Teste instabile | Teste corecte | Timp de răspuns (mediu) | Tokenuri de intrare | Tokenuri de ieșire | Tokenuri de raționament |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna | 10.0 | 10.0 | 100.0% | 0 | 26.09s | 7,140 | 234 | 268 | |
| Qwen3 Coder Next | 6.5 | 10.0 | 50.0% | 0 | 81.80s | 7,758 | 246 | 0 |
| Specific domeniului | Scor | Consistență | Rată de trecere pe încercare | Teste instabile | Teste corecte | Timp de răspuns (mediu) | Tokenuri de intrare | Tokenuri de ieșire | Tokenuri de raționament |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna | 5.9 | 7.2 | 55.6% | 1 | 22.71s | 732 | 70 | 19,191 | |
| Qwen3 Coder Next | 3.6 | 7.2 | 22.2% | 1 | 570ms | 762 | 25 | 0 |
| Inteligență generală | Scor | Consistență | Rată de trecere pe încercare | Teste instabile | Teste corecte | Timp de răspuns (mediu) | Tokenuri de intrare | Tokenuri de ieșire | Tokenuri de raționament |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna | 4.4 | 9.9 | 0.0% | 0 | 28.25s | 477 | 91 | 289 | |
| Qwen3 Coder Next | 6.3 | 3.4 | 66.7% | 1 | 1.39s | 498 | 142 | 0 |
| Respectarea instrucțiunilor | Scor | Consistență | Rată de trecere pe încercare | Teste instabile | Teste corecte | Timp de răspuns (mediu) | Tokenuri de intrare | Tokenuri de ieșire | Tokenuri de raționament |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna | 9.8 | 10.0 | 100.0% | 0 | 13.24s | 660 | 89 | 409 | |
| Qwen3 Coder Next | 6.3 | 10.0 | 50.0% | 0 | 7.49s | 684 | 63 | 0 |
| Rezolvare de puzzle-uri | Scor | Consistență | Rată de trecere pe încercare | Teste instabile | Teste corecte | Timp de răspuns (mediu) | Tokenuri de intrare | Tokenuri de ieșire | Tokenuri de raționament |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna | 7.7 | 10.0 | 66.7% | 0 | 9.78s | 642 | 211 | 3,189 | |
| Qwen3 Coder Next | 3.0 | 10.0 | 0.0% | 0 | 1.25s | 678 | 671 | 0 |
| Apelare instrumente | Scor | Consistență | Rată de trecere pe încercare | Teste instabile | Teste corecte | Timp de răspuns (mediu) | Tokenuri de intrare | Tokenuri de ieșire | Tokenuri de raționament |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna | 10.0 | 10.0 | 100.0% | 0 | 4.84s | 5,454 | 264 | 249 | |
| Qwen3 Coder Next | 10.0 | 10.0 | 100.0% | 0 | 2.64s | 8,364 | 255 | 0 |
| Cultură generală | Scor | Consistență | Rată de trecere pe încercare | Teste instabile | Teste corecte | Timp de răspuns (mediu) | Tokenuri de intrare | Tokenuri de ieșire | Tokenuri de raționament |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna | 3.0 | 10.0 | 0.0% | 0 | 6.39s | 195 | 30 | 1,731 | |
| Qwen3 Coder Next | 3.0 | 10.0 | 0.0% | 0 | 399ms | 216 | 12 | 0 |
Comparație rapidă
Schimbă perechea de comparație
Granite 4.2 8BhighvsQwen3 Coder NextmediumGPT-6 LunamediumvsGrok 4.5highLaguna S 2.1noneDisponibil gratuitvsQwen3 Coder NextmediumDeepSeek V3.2nonevsQwen3 Coder NextmediumGPT-5.4 NanononevsQwen3 Coder NextmediumKimi K3maxvsGPT-6 LunamediumNorth Mini CodenoneDisponibil gratuitvsQwen3 Coder NextmediumGemini 3.5 FlashhighvsGPT-6 LunamediumLaguna S 2.1lowDisponibil gratuitvsQwen3 Coder NextmediumMercury 2.5 PreviewnonevsQwen3 Coder NextmediumNemotron 3.5 LightninglowDisponibil gratuitvsQwen3 Coder NextmediumGPT-6 LunamediumvsGLM 5.2high