Navegação
AI BENCHY
Advertise here

Modelos comparados

Comparação benchmark Gemini 3.6 Flash (medium) vs GPT-5.6 Sol (low) vs GPT-5.6 Luna (high) vs GPT-5.6 Terra (high): Gemini 3.6 Flash (medium) lidera em Pontuação com 9.8. Gemini 3.6 Flash (medium) lidera em Confiabilidade com 10.0. GPT-5.6 Luna (high) tem o menor Custo total em $0.179. GPT-5.6 Sol (low) é o mais rápido com 9.04s.

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-09-04

Posição
#7
Total de tokens de saída
100,876
Tempo de resposta (médio)
11.86s
Custo total
$0.427
Posição
#8
Total de tokens de saída
19,946
Tempo de resposta (médio)
9.04s
Custo total
$0.357
Posição
#91
Total de tokens de saída
135,315
Tempo de resposta (médio)
16.49s
Custo total
$0.179
Posição
#70
Total de tokens de saída
56,088
Tempo de resposta (médio)
11.22s
Custo total
$0.836
Modelo recomendado GPT-5.6 Sol (low)

Oferece o melhor compromisso geral: pontuação competitiva (9.5), custo menor que os outros modelos nesta comparação e tempo de resposta equilibrado.

Comparação detalhada

Métrica Gemini 3.6 Flash Gemini 3.6 Flash medium Lançamento: 2026-07-21 GPT-5.6 Sol GPT-5.6 Sol low Lançamento: 2026-07-09 GPT-5.6 Luna GPT-5.6 Luna high Lançamento: 2026-07-09 GPT-5.6 Terra GPT-5.6 Terra high Lançamento: 2026-07-09
Pontuação 9.8 9.5 7.6 8.0
Posição #7 #8 #91 #70
Confiabilidade 10.0 10.0 10.0 10.0
Consistência 9.2 9.2 8.5 9.3
Tentativas 66/66 66/66 66/66 66/66
Testes corretos
Taxa de acerto por tentativa 95.5% 86.4% 69.7% 68.2%
Testes instáveis 2 2 4 2
Execuções totais 66 66 66 66
Custo por resultado 4.101 5.508 6.100 7.293
Custo total $0.427 $0.357 $0.179 $0.836
Preço de entrada $0.750 / 1M $2.000 / 1M $0.200 / 1M $2.000 / 1M
Preço de saída $3.750 / 1M $10.000 / 1M $1.200 / 1M $12.000 / 1M
Total de tokens de entrada 64,446 78,580 80,927 81,056
Tokens de saída 1,974 4,476 5,088 5,055
Tokens de raciocínio 98,902 15,470 130,227 51,033
Tempo de resposta (médio) 11.86s 9.04s 16.49s 11.22s
Tempo de resposta (máx.) 77.15s 53.91s 111.09s 91.49s
Tempo de resposta (total) 260.96s 198.97s 362.78s 246.77s
Parâmetros ~500B no total (~20B ativos) ~2T no total (~150B ativos) ~400B no total (~17B ativos) ~1T no total (~60B ativos)
Disponibilidade Código fechado Código fechado Código fechado Código fechado

Geração showcase de modelos

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#7 Gemini 3.6 Flash

medium
Custo
$0.095
Tempo
49.9s
Tokens
12,664 tok

#8 GPT-5.6 Sol

low
Custo
$0.062
Tempo
26.7s
Tokens
2,150 tok

#91 GPT-5.6 Luna

high
Custo
$0.033
Tempo
34.2s
Tokens
5,484 tok

#70 GPT-5.6 Terra

high
Custo
$0.055
Tempo
30.2s
Tokens
3,748 tok

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Programação Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Gemini 3.6 Flash 10.0 10.0 100.0% 0 14.81s 8,124 444 31,421
GPT-5.6 Sol 10.0 10.0 100.0% 0 11.25s 7,302 412 3,482
GPT-5.6 Luna 5.5 4.7 55.6% 2 15.63s 7,302 510 17,746
GPT-5.6 Terra 7.6 7.2 77.8% 1 9.14s 7,302 370 6,087

Comparação rápida

Trocar par de comparação