Navegação
Advertise here

Dots 3 Note Preview (medium) vs Mistral Large 4

Dots 3 Note Preview (medium) lidera na pontuação média com 5.7 vs 5.5. Dots 3 Note Preview (medium) tem menor custo de benchmark com $0.000 vs $0.353. Mistral Large 4 é mais rápido com 28.46s vs 70.32s, com taxas de acerto de 58.0% vs 30.4%.

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-10-06

Modelos comparados

Posição
#267
Total de tokens de saída
710,627
Tempo de resposta (médio)
70.32s
Custo total
$0.000
Posição
#274
Total de tokens de saída
84,218
Tempo de resposta (médio)
28.46s
Custo total
$0.353
Modelo recomendado Mistral Large 4

A pontuação fica perto da melhor aqui (5.5 vs 5.7) e responde cerca de 2.5x mais rápido que Dots 3 Note Preview (medium).

Comparação detalhada

Métrica Dots 3 Note Preview Dots 3 Note Preview medium Lançamento: 2026-08-14 Disponível grátis Mistral Large 4 Mistral Large 4 none Lançamento: 2026-10-06
Pontuação 5.7 5.5
Posição #267 #274
Confiabilidade 10.0 9.9
Consistência 6.9 8.8
Tentativas 69/69 69/69
Testes corretos
Taxa de acerto por tentativa 58.0% 30.4%
Testes instáveis 9 4
Execuções totais 69 69
Custo por resultado 0.000 7.044
Custo total $0.000 $0.353
Preço de entrada $0.000 / 1M $0.680 / 1M
Preço de saída $0.000 / 1M $2.090 / 1M
Preço de leitura do cache N/D $0.070 / 1M
Preço de escrita no cache N/D N/D
Total de tokens de entrada 208,598 259,048
Tokens de saída 120,583 84,218
Tokens de raciocínio 590,044 0
Tempo de resposta (médio) 70.32s 28.46s
Tempo de resposta (máx.) 459.19s 385.10s
Tempo de resposta (total) 1617.43s 654.47s
Parâmetros 280B no total (16B ativos) 1.05T no total (49B ativos)
Disponibilidade Código aberto Código fechado

Os preços de cache aplicam-se aos tokens de entrada. A leitura reutiliza prompts em cache; a escrita armazena-os e pode custar mais. Os tokens de saída usam o preço de saída.

Geração showcase de modelos

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#267 Dots 3 Note Preview

medium
Custo
$0.000
Tempo
585.4s
Tokens
12,198 tok

#274 Mistral Large 4

none
Custo
$0.004
Tempo
26.7s
Tokens
1,923 tok

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Programação Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Dots 3 Note Preview 4.2 5.1 33.3% 2 309.15s 7,368 29,392 373,137
Mistral Large 4 5.4 7.8 22.2% 1 153.02s 7,431 62,517 0

Comparação rápida

Trocar par de comparação