- Posição
- #79
- Total de tokens de saída
- 53,161
- Tempo de resposta (médio)
- 18.07s
- Custo total
- $0.047
GPT-6 Luna (medium) vs Qwen3 Coder Next (medium)
GPT-6 Luna (medium) lidera na pontuação média com 8.3 vs 4.7. GPT-6 Luna (medium) tem menor custo de benchmark com $0.047 vs $0.071. Qwen3 Coder Next (medium) é mais rápido com 16.97s vs 18.07s, com taxas de acerto de 73.9% vs 24.6%.
Modelos comparados
- Posição
- #323
- Total de tokens de saída
- 40,395
- Tempo de resposta (médio)
- 16.97s
- Custo total
- $0.071
Modelo recomendado
GPT-6 Luna (medium)
Tem a pontuação mais forte nesta comparação (8.3) e o melhor equilíbrio geral entre custo e tempo de resposta entre os 2 modelos.
Comparação detalhada
| Métrica | GPT-6 Luna GPT-6 Luna medium | Qwen3 Coder Next Qwen3 Coder Next medium |
|---|---|---|
| Pontuação | 8.3 | 4.7 |
| Posição | #79 | #323 |
| Confiabilidade | 10.0 | 10.0 |
| Consistência | 8.9 | 8.7 |
| Tentativas | 69/69 | 69/69 |
| Testes corretos | ||
| Taxa de acerto por tentativa | 73.9% | 24.6% |
| Testes instáveis | 3 | 4 |
| Execuções totais | 69 | 69 |
| Custo por resultado | 0.313 | 2.280 |
| Custo total | $0.047 | $0.071 |
| Preço de entrada | $0.100 / 1M | $0.120 / 1M |
| Preço de saída | $0.500 / 1M | $0.800 / 1M |
| Preço de leitura do cache | $0.010 / 1M | $0.070 / 1M |
| Preço de escrita no cache | $0.125 / 1M | N/D |
| Total de tokens de entrada | 203,193 | 311,647 |
| Tokens de saída | 5,751 | 40,395 |
| Tokens de raciocínio | 47,410 | 0 |
| Tempo de resposta (médio) | 18.07s | 16.97s |
| Tempo de resposta (máx.) | 66.44s | 151.35s |
| Tempo de resposta (total) | 415.53s | 305.55s |
| Parâmetros | ~400B no total (~17B ativos) | 80B no total (3B ativos) |
| Disponibilidade | Código fechado | Código aberto |
Os preços de cache aplicam-se aos tokens de entrada. A leitura reutiliza prompts em cache; a escrita armazena-os e pode custar mais. Os tokens de saída usam o preço de saída.
Geração showcase de modelos
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#79 GPT-6 Luna
medium- Custo
- $0.002
- Tempo
- 23.6s
- Tokens
- 2,966 tok
#323 Qwen3 Coder Next
medium
Reached the allocated time limit (300 seconds) without receiving showcase output.
- Custo
- $0.000
- Tempo
- 300.0s
- Tokens
- 0 tok
Melhores modelos por pontuação
Pontuação vs custo total
Tempo de resposta (médio)
Pontuação vs Tempo de resposta (médio)
Total de tokens de saída
Pontuação vs Total de tokens de saída
Detalhamento por categoria
| Tarefas de agentes | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna | 10.0 | 10.0 | 100.0% | 0 | 66.44s | 124,247 | 1,116 | 6,891 | |
| Qwen3 Coder Next | 5.0 | 10.0 | 0.0% | 0 | 151.35s | 163,444 | 21,326 | 0 |
| Truques anti-IA | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna | 8.3 | 10.0 | 75.0% | 0 | 4.32s | 606 | 156 | 875 | |
| Qwen3 Coder Next | 3.5 | 8.1 | 16.7% | 1 | 8.64s | 645 | 1,252 | 0 |
| Programação | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna | 6.6 | 4.6 | 77.8% | 2 | 23.63s | 7,302 | 438 | 10,222 | |
| Qwen3 Coder Next | 3.7 | 7.2 | 22.2% | 1 | 924ms | 7,185 | 336 | 0 |
| Combinado | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna | 10.0 | 10.0 | 100.0% | 0 | 22.65s | 55,738 | 3,052 | 4,096 | |
| Qwen3 Coder Next | 3.0 | 10.0 | 0.0% | 0 | 14.65s | 121,413 | 16,067 | 0 |
| Análise e extração de dados | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna | 10.0 | 10.0 | 100.0% | 0 | 26.09s | 7,140 | 234 | 268 | |
| Qwen3 Coder Next | 6.5 | 10.0 | 50.0% | 0 | 81.80s | 7,758 | 246 | 0 |
| Específico do domínio | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna | 5.9 | 7.2 | 55.6% | 1 | 22.71s | 732 | 70 | 19,191 | |
| Qwen3 Coder Next | 3.6 | 7.2 | 22.2% | 1 | 570ms | 762 | 25 | 0 |
| Inteligência geral | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna | 4.4 | 9.9 | 0.0% | 0 | 28.25s | 477 | 91 | 289 | |
| Qwen3 Coder Next | 6.3 | 3.4 | 66.7% | 1 | 1.39s | 498 | 142 | 0 |
| Seguimento de instruções | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna | 9.8 | 10.0 | 100.0% | 0 | 13.24s | 660 | 89 | 409 | |
| Qwen3 Coder Next | 6.3 | 10.0 | 50.0% | 0 | 7.49s | 684 | 63 | 0 |
| Resolução de quebra-cabeças | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna | 7.7 | 10.0 | 66.7% | 0 | 9.78s | 642 | 211 | 3,189 | |
| Qwen3 Coder Next | 3.0 | 10.0 | 0.0% | 0 | 1.25s | 678 | 671 | 0 |
| Chamada de ferramentas | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna | 10.0 | 10.0 | 100.0% | 0 | 4.84s | 5,454 | 264 | 249 | |
| Qwen3 Coder Next | 10.0 | 10.0 | 100.0% | 0 | 2.64s | 8,364 | 255 | 0 |
| Conhecimentos gerais | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna | 3.0 | 10.0 | 0.0% | 0 | 6.39s | 195 | 30 | 1,731 | |
| Qwen3 Coder Next | 3.0 | 10.0 | 0.0% | 0 | 399ms | 216 | 12 | 0 |
Comparação rápida
Trocar par de comparação
Granite 4.2 8BhighvsQwen3 Coder NextmediumGPT-6 LunamediumvsGrok 4.5highLaguna S 2.1noneDisponível grátisvsQwen3 Coder NextmediumDeepSeek V3.2nonevsQwen3 Coder NextmediumGPT-5.4 NanononevsQwen3 Coder NextmediumKimi K3maxvsGPT-6 LunamediumNorth Mini CodenoneDisponível grátisvsQwen3 Coder NextmediumGemini 3.5 FlashhighvsGPT-6 LunamediumLaguna S 2.1lowDisponível grátisvsQwen3 Coder NextmediumMercury 2.5 PreviewnonevsQwen3 Coder NextmediumNemotron 3.5 LightninglowDisponível grátisvsQwen3 Coder NextmediumGPT-6 LunamediumvsGLM 5.2high