Navegação
AI BENCHY
Advertise here

Ling 3.0 Flash vs Kwaipilot: KAT-Coder-Air V2.5

A pontuação média está praticamente empatada em 5.7 vs 5.6. Ling 3.0 Flash tem menor custo de benchmark com $0.000 vs $0.077. Ling 3.0 Flash é mais rápido com 3.46s vs 15.90s, com taxas de acerto de 27.3% vs 43.9%.

Modelo recomendadoLing 3.0 FlashTem a melhor pontuação aqui (5.7) e responde cerca de 4.6x mais rápido que KAT-Coder-Air V2.5 (high).

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-07-24

Métrica Ling 3.0 Flash Ling 3.0 Flash none Lançamento: 2026-07-24 Disponível grátis KAT-Coder-Air V2.5 KAT-Coder-Air V2.5 high Lançamento: 2026-07-14
Pontuação 5.7 5.6
Posição #149 #152
Confiabilidade 9.9 9.9
Consistência 10.0 7.7
Testes corretos
Taxa de acerto por tentativa 27.3% 43.9%
Testes instáveis 0 6
Execuções totais 66 66
Custo por resultado 0.000 1.097
Custo total $0.000 $0.077
Preço de entrada $0.000 / 1M $0.150 / 1M
Preço de saída $0.000 / 1M $0.600 / 1M
Total de tokens de entrada 124,176 50,470
Tokens de saída 12,783 3,957
Tokens de raciocínio 0 111,374
Tempo de resposta (médio) 3.46s 15.90s
Tempo de resposta (máx.) 17.51s 118.35s
Tempo de resposta (total) 76.06s 349.71s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#149 Ling 3.0 Flash

none
Custo
$0.000
Tempo
11.6s
Tokens
2,781 tok

#152 KAT-Coder-Air V2.5

high
SVG inválido
Custo
$0.000
Tempo
300.0s
Tokens
0 tok

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Programação Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Ling 3.0 Flash 5.5 10.0 33.3% 0 6.39s 8,307 639 0
KAT-Coder-Air V2.5 4.3 7.3 11.1% 1 39.07s 6,948 1,166 55,883

Comparação rápida

Trocar par de comparação