Navegação
AI BENCHY
Advertise here

Modelos comparados

Comparação benchmark GPT-5.6 Sol (medium) vs GPT-5.6 Terra (medium) vs GPT-5.6 Luna (medium) vs GPT-5.5 (medium): GPT-5.6 Sol (medium) lidera em Pontuação com 9.4. GPT-5.6 Sol (medium) lidera em Confiabilidade com 10.0. GPT-5.6 Luna (medium) tem o menor Custo total em $0.072. GPT-5.6 Terra (medium) é o mais rápido com 6.85s.

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-08-20

Posição
#8
Total de tokens de saída
34,977
Tempo de resposta (médio)
12.63s
Custo total
$0.723
Posição
#66
Total de tokens de saída
30,349
Tempo de resposta (médio)
6.85s
Custo total
$0.523
Posição
#93
Total de tokens de saída
44,525
Tempo de resposta (médio)
7.43s
Custo total
$0.072
Posição
#19
Total de tokens de saída
125,316
Tempo de resposta (médio)
38.97s
Custo total
$4.163
Modelo recomendado GPT-5.6 Sol (medium)

Tem a melhor pontuação aqui (9.4) e custa cerca de 2.2x menos que os outros modelos nesta comparação.

Comparação detalhada

Métrica GPT-5.6 Sol GPT-5.6 Sol medium Lançamento: 2026-07-09 GPT-5.6 Terra GPT-5.6 Terra medium Lançamento: 2026-07-09 GPT-5.6 Luna GPT-5.6 Luna medium Lançamento: 2026-07-09 GPT-5.5 GPT-5.5 medium Lançamento: 2026-04-24
Pontuação 9.4 7.8 7.4 9.0
Posição #8 #66 #93 #19
Confiabilidade 10.0 10.0 10.0 10.0
Consistência 8.9 9.3 9.2 8.9
Tentativas 66/66 66/66 66/66 66/66
Testes corretos
Taxa de acerto por tentativa 90.9% 69.7% 62.1% 87.9%
Testes instáveis 3 2 2 3
Execuções totais 66 66 66 66
Custo por resultado 8.025 4.603 2.601 23.127
Custo total $0.723 $0.523 $0.072 $4.163
Preço de entrada $2.500 / 1M $2.000 / 1M $0.200 / 1M $5.000 / 1M
Preço de saída $15.000 / 1M $12.000 / 1M $1.200 / 1M $30.000 / 1M
Total de tokens de entrada 79,006 79,184 89,685 80,668
Tokens de saída 4,696 4,878 5,701 5,617
Tokens de raciocínio 30,281 25,471 38,824 119,699
Tempo de resposta (médio) 12.63s 6.85s 7.43s 38.97s
Tempo de resposta (máx.) 79.40s 41.68s 29.85s 332.10s
Tempo de resposta (total) 277.88s 150.65s 163.54s 857.43s
Parâmetros ~2T no total (~150B ativos) ~1T no total (~60B ativos) ~400B no total (~17B ativos) ~1.5T no total (~100B ativos)
Disponibilidade Código fechado Código fechado Código fechado Código fechado

Geração showcase de modelos

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#8 GPT-5.6 Sol

medium
Custo
$0.124
Tempo
57.2s
Tokens
4,199 tok

#66 GPT-5.6 Terra

medium
Custo
$0.035
Tempo
16.3s
Tokens
2,418 tok

#93 GPT-5.6 Luna

medium
Custo
$0.014
Tempo
14.6s
Tokens
2,362 tok

#19 GPT-5.5

medium
Custo
$0.112
Tempo
71.9s
Tokens
3,807 tok

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Programação Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
GPT-5.6 Sol 10.0 10.0 100.0% 0 9.40s 7,302 394 4,706
GPT-5.6 Terra 6.1 7.2 55.6% 1 7.19s 7,302 427 4,527
GPT-5.6 Luna 5.4 7.2 44.4% 1 10.38s 7,302 564 9,928
GPT-5.5 8.8 7.8 88.9% 1 59.77s 7,305 362 24,959

Comparação rápida

Trocar par de comparação