Navegação
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Modelos comparados

Comparação benchmark GPT-5.4 (medium) vs GPT-5.4 Mini (medium) vs GPT-5.4 Nano (medium) vs GPT-5 Mini (medium): GPT-5.4 (medium) lidera em Pontuação com 8.5. GPT-5.4 (medium) lidera em Confiabilidade com 10.0. GPT-5.4 Nano (medium) tem o menor Custo total em $0.138. GPT-5.4 Nano (medium) é o mais rápido com 13.24s.

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-08-05

Posição
#29
Total de tokens de saída
88,670
Tempo de resposta (médio)
23.10s
Custo total
$1.533
Posição
#74
Total de tokens de saída
151,755
Tempo de resposta (médio)
25.94s
Custo total
$0.756
Posição
#71
Total de tokens de saída
97,122
Tempo de resposta (médio)
13.24s
Custo total
$0.138
Posição
#40
Total de tokens de saída
105,932
Tempo de resposta (médio)
27.63s
Custo total
$0.237
Modelo recomendado GPT-5.4 Nano (medium)

Oferece o melhor compromisso geral: pontuação competitiva (7.5), custo menor que os outros modelos nesta comparação e tempo de resposta equilibrado.

Comparação detalhada

Métrica GPT-5.4 GPT-5.4 medium Lançamento: 2026-03-05 GPT-5.4 Mini GPT-5.4 Mini medium Lançamento: 2026-03-17 GPT-5.4 Nano GPT-5.4 Nano medium Lançamento: 2026-03-17 GPT-5 Mini GPT-5 Mini medium Lançamento: 2025-08-07
Pontuação 8.5 7.5 7.5 8.1
Posição #29 #74 #71 #40
Confiabilidade 10.0 10.0 10.0 10.0
Consistência 8.6 7.7 8.5 8.8
Cobertura do benchmark 22/22 testes · 66/66 tentativas 22/22 testes · 66/66 tentativas 22/22 testes · 66/66 tentativas 22/22 testes · 66/66 tentativas
Testes corretos
Taxa de acerto por tentativa 77.3% 71.2% 65.2% 63.6%
Testes instáveis 4 6 4 3
Execuções totais 66 66 66 66
Custo por resultado 10.220 6.299 1.150 1.971
Custo total $1.533 $0.756 $0.138 $0.237
Preço de entrada $2.500 / 1M $0.750 / 1M $0.200 / 1M $0.250 / 1M
Preço de saída $15.000 / 1M $4.500 / 1M $1.250 / 1M $2.000 / 1M
Total de tokens de entrada 81,127 97,155 82,819 98,374
Tokens de saída 6,155 6,211 7,100 14,434
Tokens de raciocínio 82,515 145,544 90,022 91,498
Tempo de resposta (médio) 23.10s 25.94s 13.24s 27.63s
Tempo de resposta (máx.) 100.41s 138.75s 94.06s 111.48s
Tempo de resposta (total) 508.26s 570.66s 291.33s 607.92s

Geração showcase de modelos

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#29 GPT-5.4

medium
Custo
$0.214
Tempo
199.6s
Tokens
14,349 tok

#74 GPT-5.4 Mini

medium
Custo
$0.056
Tempo
95.5s
Tokens
12,464 tok

#71 GPT-5.4 Nano

medium
Custo
$0.007
Tempo
24.6s
Tokens
4,943 tok

#40 GPT-5 Mini

medium
Custo
$0.007
Tempo
42.9s
Tokens
3,432 tok

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Programação Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
GPT-5.4 8.8 7.8 88.9% 1 44.36s 7,305 433 24,216
GPT-5.4 Mini 8.4 7.4 88.9% 1 57.87s 7,305 467 40,902
GPT-5.4 Nano 6.1 4.7 66.7% 2 19.12s 7,305 516 20,778
GPT-5 Mini 10.0 10.0 100.0% 0 27.63s 7,302 658 17,152

Comparação rápida

Trocar par de comparação