Advertise here
#159

GPT-6 Luna

OpenAI Lançamento: 2026-09-23 Testado em: 2026-09-23 05:09 openai/gpt-6-luna::low
~400B no total (~17B ativos)MoECódigo fechadoEstimado

Resumo

GPT-6 Luna marca 7.0 no AI BENCHY e fica em #159. Tem fiabilidade 9.6, taxa de acerto de 62.1%, custo total de $0.020 e tempo médio de resposta de 21.96s.

O que torna GPT-6 Luna único: Destaca-se mais em Específico do domínio, onde fica em #2, enquanto Truques anti-IA é a área mais fraca em #14. O custo total do benchmark é invulgarmente baixo para este nível de pontuação.

Dados do modelo

Pesquisado em 2026-09-23

Estimado
Parâmetros
~400B no total (~17B ativos)
Arquitetura
MoE
Disponibilidade
Código fechado
Licença
-

Melhor estimativa com base em evidências públicas; o fornecedor não divulgou todos os valores.

Consistência

8.5

Total de tokens de saída

22,605

Total de tokens de entrada

80,159

Preço de entrada

$0.100 / 1M

Preço de saída

$0.500 / 1M

Testes corretos

Testes errados: 11

Taxa de acerto por tentativa: 62.1%

Testes instáveis

4

Testes instáveis tiveram resultados mistos entre execuções (pelo menos um acerto e uma falha).

Tempo de resposta (médio)

21.96s

Tempo de resposta (máx.): 89.37s

Tempo de resposta (total): 483.19s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#159 GPT-6 Luna

low
Custo
$0.002
Tempo
19.2s
Tokens
2,598 tok

Gráficos

Escolha o primeiro modelo e depois clique em um segundo modelo para abrir uma página lado a lado.

Total de tokens de saída

Pontuação vs Total de tokens de saída

Comparação rápida

Detalhamento por categoria

Categoria Pontuação Consistência Testes corretos
Truques anti-IA 6.9 7.9
Programação 6.0 7.2
Combinado 7.3 5.8
Análise e extração de dados 10.0 10.0
Específico do domínio 5.3 10.0
Inteligência geral 4.4 9.9
Seguimento de instruções 7.1 5.8
Resolução de quebra-cabeças 7.7 10.0
Chamada de ferramentas 10.0 10.0
Conhecimentos gerais 3.0 10.0

Modelos comparados