Navegação
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 3.5 Flash vs inclusionAI: Ling-2.6-flash

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-05-22

Métrica Gemini 3.5 Flash Gemini 3.5 Flash low Lançamento: 2026-05-19 Ling-2.6-flash Ling-2.6-flash none Lançamento: 2026-04-21
Pontuação 9.3 5.3
Posição #3 #128
Confiabilidade 10.0 10.0
Consistência 10.0 9.2
Testes corretos
Taxa de acerto por tentativa 90.0% 35.1%
Testes instáveis 0 2
Execuções totais 60 60
Custo por resultado 1.582 0.005
Custo total $0.285 $0.001
Preço de entrada $1.500 / 1M $0.010 / 1M
Preço de saída $9.000 / 1M $0.030 / 1M
Tokens de saída 2,027 2,878
Tokens de raciocínio 23,938 0
Tempo de resposta (médio) 2.98s 9.76s
Tempo de resposta (máx.) 6.44s 35.34s
Tempo de resposta (total) 59.59s 185.37s

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Truques anti-IA Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.52s 209 2,536
Ling-2.6-flash 6.8 8.1 58.3% 1 11.81s 573 0
Programação Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemini 3.5 Flash 6.8 10.0 50.0% 0 5.54s 452 6,839
Ling-2.6-flash 10.0 10.0 100.0% 0 11.21s 381 0
Combinado Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemini 3.5 Flash 10.0 10.0 100.0% 0 6.44s 351 3,050
Ling-2.6-flash 3.0 10.0 0.0% 0 35.34s 1,069 0
Análise e extração de dados Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemini 3.5 Flash 10.0 10.0 100.0% 0 1.81s 279 1,164
Ling-2.6-flash 6.5 10.0 50.0% 0 8.48s 246 0
Específico do domínio Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemini 3.5 Flash 7.7 10.0 66.7% 0 3.39s 12 4,538
Ling-2.6-flash 3.0 10.0 0.0% 0 4.95s 24 0
Inteligência geral Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.27s 119 916
Ling-2.6-flash 4.0 10.0 0.0% 0 1.45s 109 0
Seguimento de instruções Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemini 3.5 Flash 9.9 10.0 100.0% 0 1.86s 71 1,652
Ling-2.6-flash 9.8 10.0 100.0% 0 5.52s 81 0
Resolução de quebra-cabeças Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.35s 288 2,150
Ling-2.6-flash 2.9 7.2 11.1% 1 9.14s 151 0
Chamada de ferramentas Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.27s 234 403
Ling-2.6-flash 3.0 10.0 0.0% 0 18.80s 229 0
Conhecimentos gerais Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemini 3.5 Flash 10.0 10.0 100.0% 0 1.88s 12 690
Ling-2.6-flash 3.0 10.0 0.0% 0 1.06s 15 0

Comparação rápida

Trocar par de comparação