Navegação
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-5.6 Luna (medium) vs Solar Pro 4 (xhigh)

Solar Pro 4 (xhigh) lidera na pontuação média com 7.7 vs 7.6. GPT-5.6 Luna (medium) tem menor custo de benchmark com $0.036 vs $0.049. GPT-5.6 Luna (medium) é mais rápido com 7.28s vs 115.81s, com taxas de acerto de 65.2% vs 65.2%.

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-08-11

Posição
#69
Total de tokens de saída
43,679
Tempo de resposta (médio)
7.28s
Custo total
$0.036
Posição
#63
Total de tokens de saída
379,812
Tempo de resposta (médio)
115.81s
Custo total
$0.049
Modelo recomendado GPT-5.6 Luna (medium)

A pontuação fica perto da melhor aqui (7.6 vs 7.7) e responde cerca de 15.9x mais rápido que Solar Pro 4 (xhigh).

Comparação detalhada

Métrica GPT-5.6 Luna GPT-5.6 Luna medium Lançamento: 2026-07-09 Solar Pro 4 Solar Pro 4 xhigh Lançamento: 2026-08-11
Pontuação 7.6 7.7
Posição #69 #63
Confiabilidade 10.0 10.0
Consistência 9.6 9.4
Cobertura do benchmark 22/22 testes · 66/66 tentativas 22/22 testes · 66/66 tentativas
Testes corretos
Taxa de acerto por tentativa 65.2% 65.2%
Testes instáveis 1 2
Execuções totais 66 66
Custo por resultado 2.513 0.374
Custo total $0.036 $0.049
Preço de entrada $0.100 / 1M $0.030 / 1M
Preço de saída $0.600 / 1M $0.120 / 1M
Total de tokens de entrada 89,676 98,107
Tokens de saída 5,699 21,723
Tokens de raciocínio 37,980 358,089
Tempo de resposta (médio) 7.28s 115.81s
Tempo de resposta (máx.) 29.85s 419.47s
Tempo de resposta (total) 160.27s 2547.92s

Geração showcase de modelos

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#69 GPT-5.6 Luna

medium
Custo
$0.014
Tempo
14.6s
Tokens
2,362 tok

#63 Solar Pro 4

xhigh
Nenhum resultado showcase foi gerado para este modelo ainda.
Custo
$0.000
Tempo
-
Tokens
0 tok

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Programação Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
GPT-5.6 Luna 5.4 7.2 44.4% 1 10.38s 7,302 564 9,928
Solar Pro 4 5.8 9.9 33.3% 0 292.21s 7,887 15,575 115,426

Comparação rápida

Trocar par de comparação