Navegação
AI BENCHY
Advertise here

Seed-2.0-Mini (medium) vs GLM 5.1 (medium)

A pontuação média está praticamente empatada em 7.0 vs 7.0. Seed-2.0-Mini (medium) tem menor custo de benchmark com $0.116 vs $0.727. GLM 5.1 (medium) é mais rápido com 58.80s vs 93.10s, com taxas de acerto de 57.6% vs 65.2%.

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-08-20

Posição
#122
Total de tokens de saída
258,322
Tempo de resposta (médio)
93.10s
Custo total
$0.116
Posição
#118
Total de tokens de saída
215,889
Tempo de resposta (médio)
58.80s
Custo total
$0.727
Modelo recomendado Seed-2.0-Mini (medium)

Tem a melhor pontuação aqui (7.0) e custa cerca de 6.3x menos que GLM 5.1 (medium).

Comparação detalhada

Métrica Seed-2.0-Mini Seed-2.0-Mini medium Lançamento: 2026-02-14 GLM 5.1 GLM 5.1 medium Lançamento: 2026-04-07
Pontuação 7.0 7.0
Posição #122 #118
Confiabilidade 8.7 8.1
Consistência 8.9 8.4
Tentativas 66/66 66/66
Testes corretos
Taxa de acerto por tentativa 57.6% 65.2%
Testes instáveis 3 4
Execuções totais 66 66
Custo por resultado 1.054 6.923
Custo total $0.116 $0.727
Preço de entrada $0.100 / 1M $0.966 / 1M
Preço de saída $0.400 / 1M $3.036 / 1M
Total de tokens de entrada 125,704 82,592
Tokens de saída 10,781 16,089
Tokens de raciocínio 247,541 199,800
Tempo de resposta (médio) 93.10s 58.80s
Tempo de resposta (máx.) 301.78s 308.75s
Tempo de resposta (total) 1768.91s 1234.72s
Parâmetros ~50B no total (~5B ativos) 744B no total (40B ativos)
Disponibilidade Código fechado Código aberto

Geração showcase de modelos

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#122 Seed-2.0-Mini

medium
Custo
$0.002
Tempo
161.7s
Tokens
4,379 tok

#118 GLM 5.1

medium
SVG inválido
Custo
$0.000
Tempo
300.0s
Tokens
0 tok

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Programação Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Seed-2.0-Mini 5.5 9.8 33.3% 0 220.48s 3,823 464 34,964
GLM 5.1 4.6 3.7 44.5% 2 109.63s 5,702 4,871 37,826

Comparação rápida

Trocar par de comparação