Navegação
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 3.1 Flash Lite vs inclusionAI: Ring-2.6-1T

Resumo

Comparação benchmark Gemini 3.1 Flash Lite vs Ring-2.6-1T: Ring-2.6-1T lidera na pontuação média com 6.8 vs 6.4. Gemini 3.1 Flash Lite tem menor custo de benchmark com $0.028 vs $0.033. Gemini 3.1 Flash Lite é mais rápido com 1.89s vs 61.29s, com taxas de acerto de 61.9% vs 60.3%.

Modelo recomendado: Gemini 3.1 Flash Lite - A pontuação fica perto da melhor aqui (6.4 vs 6.8) e responde cerca de 32.5x mais rápido que Ring-2.6-1T.

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-06-18

Métrica Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite low Lançamento: 2026-05-08 Ring-2.6-1T Ring-2.6-1T medium Lançamento: 2026-05-10
Pontuação 6.4 6.8
Posição #85 #72
Confiabilidade 10.0 10.0
Consistência 9.3 8.8
Testes corretos
Taxa de acerto por tentativa 61.9% 60.3%
Testes instáveis 2 3
Execuções totais 63 63
Custo por resultado 0.227 0.000
Custo total $0.028 $0.033
Preço de entrada $0.250 / 1M $0.075 / 1M
Preço de saída $1.500 / 1M $0.625 / 1M
Total de tokens de entrada 36,892 35,892
Tokens de saída 2,732 21,752
Tokens de raciocínio 9,260 42,754
Tempo de resposta (médio) 1.89s 61.29s
Tempo de resposta (máx.) 5.66s 304.19s
Tempo de resposta (total) 39.62s 1164.50s

Geração showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#85 Gemini 3.1 Flash Lite

low
Custo
$0.003
Tempo
4.0s
Tokens
1,479 tok

#72 Ring-2.6-1T

medium
Ring-2.6-1T is no longer available as a free model. It has transitioned to a paid model. Continue using it here: https://openrouter.ai/inclusionai/ring-2.6-1t
Custo
$0.000
Tempo
0.1s
Tokens
0 tok

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Truques anti-IA Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Gemini 3.1 Flash Lite 7.3 6.2 75.0% 2 1.84s 500 1,013 1,548
Ring-2.6-1T 10.0 10.0 100.0% 0 42.21s 810 3,833 4,891
Programação Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Gemini 3.1 Flash Lite 5.5 10.0 33.3% 0 1.53s 8,132 471 1,072
Ring-2.6-1T 5.3 10.0 33.3% 0 59.65s 834 1,369 3,985
Combinado Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Gemini 3.1 Flash Lite 3.0 10.0 0.0% 0 4.48s 12,870 348 975
Ring-2.6-1T 10.0 10.0 100.0% 0 304.19s 14,823 324 6,088
Análise e extração de dados Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 1.44s 7,453 291 697
Ring-2.6-1T 6.5 10.0 50.0% 0 37.36s 8,046 840 1,937
Específico do domínio Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Gemini 3.1 Flash Lite 5.3 10.0 33.3% 0 1.52s 639 15 1,214
Ring-2.6-1T 3.5 4.4 33.3% 2 64.92s 873 9,744 15,013
Inteligência geral Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Gemini 3.1 Flash Lite 4.0 10.0 0.0% 0 1.37s 492 69 438
Ring-2.6-1T 4.1 10.0 0.0% 0 58.26s 561 150 583
Seguimento de instruções Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 1.52s 619 72 760
Ring-2.6-1T 9.8 10.0 100.0% 0 11.78s 774 266 1,831
Resolução de quebra-cabeças Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 1.40s 570 210 1,191
Ring-2.6-1T 5.9 7.2 55.6% 1 20.73s 792 697 2,479
Chamada de ferramentas Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 5.66s 5,457 234 945
Ring-2.6-1T 10.0 10.0 100.0% 0 104.44s 8,136 234 1,531
Conhecimentos gerais Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Gemini 3.1 Flash Lite 3.0 10.0 0.0% 0 1.46s 160 9 420
Ring-2.6-1T 3.0 10.0 0.0% 0 113.91s 243 4,295 4,416

Comparação rápida

Trocar par de comparação