#84 Ling 2.6 Flash
none- Custo
- $0.000
- Tempo
- 0.0s
- Tokens
- 0 tok
Resumo
Ling-2.6-flash marca 5.4 no AI BENCHY e fica em #84. Tem fiabilidade N/D, taxa de acerto de 35.2%, custo total de $0.000 e tempo médio de resposta de 11.33s.
O que torna Ling-2.6-flash único: Destaca-se mais em Programação, onde fica em #1, enquanto Análise e extração de dados é a área mais fraca em #18. O custo total do benchmark é invulgarmente baixo para este nível de pontuação.
5.4
Consistência
9.5
$0.000
Total de tokens de saída
3,338
Total de tokens de entrada
0
Preço de entrada
$0.000 / 1M
Preço de saída
$0.000 / 1M
Testes instáveis
1
Testes instáveis tiveram resultados mistos entre execuções (pelo menos um acerto e uma falha).
11.33s
Tempo de resposta (máx.): 35.34s
Tempo de resposta (total): 203.88s
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
Histórico de execuções
| Testado em | Pontuação | Confiabilidade | Testes corretos | Custo total | Comparar |
|---|---|---|---|---|---|
| 2026-07-16 23:16 Novo teste adicionado | 4.9 | 10.0 | $0.002 ↑ | Comparar | |
| 2026-06-04 14:30 Novo teste adicionado | 5.0 | 10.0 | $0.001 ↑ | Comparar | |
| 2026-05-22 00:42 Suite alterada | 5.3 | 10.0 | $0.001 | Comparar | |
| 2026-05-08 15:30 Suite alterada | 5.3 | 10.0 | $0.001 | Comparar | |
| 2026-04-22 12:55 Primeira execução registrada | 5.4 | N/D | $0.000 | Execução atual |
Comparação de execuções
| Execução | Pontuação | Consistência | Confiabilidade | Testes corretos | Testes instáveis | Total de tokens de saída | Total de tokens de entrada | Custo total | Tempo de resposta (médio) |
|---|---|---|---|---|---|---|---|---|---|
| 2026-04-22 12:55 · Primeira execução registrada | 5.4 | 9.5 | N/D | 6/18 | 1 | 3,338 | 0 | $0.000 | 11.33s |
| 2026-07-16 23:16 · Novo teste adicionado | 4.9 | 9.3 | 10.0 | 6/22 | 2 | 14,903 | 114,375 | $0.002 | 10.68s |
| Diferença | +0.5 | +0.2 | 0 | -1 | -11565 | -114375 | -$0.002 | +651ms |
Estas duas execuções usaram suites de benchmark diferentes, então as diferenças refletem tanto mudanças do modelo quanto da suite.
Escolha o primeiro modelo e depois clique em um segundo modelo para abrir uma página lado a lado.
| Categoria | Pontuação | Consistência | Testes corretos |
|---|---|---|---|
| Truques anti-IA | 6.5 | 10.0 | |
| Programação | 10.0 | 10.0 | |
| Combinado | 3.0 | 10.0 | |
| Análise e extração de dados | 6.5 | 10.0 | |
| Específico do domínio | 3.0 | 10.0 | |
| Inteligência geral | 4.1 | 10.0 | |
| Seguimento de instruções | 9.8 | 10.0 | |
| Resolução de quebra-cabeças | 2.9 | 7.2 | |
| Chamada de ferramentas | 3.0 | 10.0 |