- Posição
- #337
- Total de tokens de saída
- 118,380
- Tempo de resposta (médio)
- 38.01s
- Custo total
- $0.000
Cobuddy (medium) vs Ling 3.0 Tiny (high)
Cobuddy (medium) lidera na pontuação média com 4.4 vs 3.7. O custo de benchmark está praticamente empatado em $0.000 vs $0.000. Cobuddy (medium) é mais rápido com 38.01s vs 72.24s, com taxas de acerto de 43.5% vs 23.2%.
Modelos comparados
- Posição
- #354
- Total de tokens de saída
- 950,683
- Tempo de resposta (médio)
- 72.24s
- Custo total
- $0.000
Modelo recomendado
Cobuddy (medium)
Tem a melhor pontuação aqui (4.4) e responde cerca de 1.9x mais rápido que Ling 3.0 Tiny (high).
Comparação detalhada
| Métrica | Cobuddy Cobuddy medium Disponível grátis | Ling 3.0 Tiny Ling 3.0 Tiny high |
|---|---|---|
| Pontuação | 4.4 | 3.7 |
| Posição | #337 | #354 |
| Confiabilidade | 10.0 | 10.0 |
| Consistência | 7.3 | 8.9 |
| Tentativas | 66/69 | 69/69 |
| Testes corretos | ||
| Taxa de acerto por tentativa | 43.5% | 23.2% |
| Testes instáveis | 6 | 3 |
| Execuções totais | 66 | 69 |
| Custo por resultado | 0.000 | 0.000 |
| Custo total | $0.000 | $0.000 |
| Preço de entrada | $0.000 / 1M | $0.000 / 1M |
| Preço de saída | $0.000 / 1M | $0.000 / 1M |
| Total de tokens de entrada | 37,449 | 115,314 |
| Tokens de saída | 1,677 | 133,965 |
| Tokens de raciocínio | 116,703 | 816,718 |
| Tempo de resposta (médio) | 38.01s | 72.24s |
| Tempo de resposta (máx.) | 309.02s | 345.15s |
| Tempo de resposta (total) | 798.15s | 1589.23s |
| Parâmetros | ~21B no total (~3B ativos) | 7.9B no total (1.3B ativos) |
| Disponibilidade | Código fechado | Código aberto |
Geração showcase de modelos
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#337 Cobuddy
medium
No endpoints found for baidu/cobuddy:free.
- Custo
- $0.000
- Tempo
- 0.1s
- Tokens
- 0 tok
#354 Ling 3.0 Tiny
high
No output was saved. The original provider response or failure reason is unavailable.
- Custo
- $0.000
- Tempo
- 169.5s
- Tokens
- 5,252 tok
Melhores modelos por pontuação
Pontuação vs custo total
Tempo de resposta (médio)
Pontuação vs Tempo de resposta (médio)
Total de tokens de saída
Pontuação vs Total de tokens de saída
Detalhamento por categoria
| Tarefas de agentes | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| Cobuddy | 3.0 | 10.0 | 0.0% | 0 | 173ms | 0 | 0 | 0 | |
| Ling 3.0 Tiny | 3.0 | 10.0 | 0.0% | 0 | 28ms | 0 | 0 | 0 |
| Truques anti-IA | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| Cobuddy | 8.7 | 7.9 | 91.7% | 1 | 10.00s | 453 | 98 | 4,666 | |
| Ling 3.0 Tiny | 6.4 | 7.9 | 58.3% | 1 | 24.93s | 750 | 5,102 | 94,893 |
| Programação | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| Cobuddy | 3.7 | 6.7 | 22.2% | 1 | 79.17s | 4,726 | 358 | 30,138 | |
| Ling 3.0 Tiny | 2.9 | 10.0 | 0.0% | 0 | 177.65s | 7,767 | 59,320 | 177,922 |
| Combinado | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| Cobuddy | 1.5 | 5.0 | 0.0% | 0 | 47.38s | 18,324 | 465 | 7,265 | |
| Ling 3.0 Tiny | 3.0 | 10.0 | 0.0% | 0 | 179.85s | 87,658 | 19,652 | 152,168 |
| Análise e extração de dados | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| Cobuddy | 6.3 | 5.8 | 66.7% | 1 | 17.36s | 8,181 | 275 | 5,591 | |
| Ling 3.0 Tiny | 2.8 | 10.0 | 0.0% | 0 | 4.16s | 8,016 | 1,561 | 5,372 |
| Específico do domínio | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| Cobuddy | 2.9 | 4.4 | 22.2% | 2 | 128.15s | 540 | 10 | 49,454 | |
| Ling 3.0 Tiny | 2.9 | 7.2 | 11.1% | 1 | 70.12s | 648 | 22,445 | 155,528 |
| Inteligência geral | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| Cobuddy | 4.2 | 9.9 | 0.0% | 0 | 23.23s | 498 | 76 | 3,782 | |
| Ling 3.0 Tiny | 5.4 | 2.5 | 66.7% | 1 | 60.50s | 546 | 4,900 | 61,589 |
| Seguimento de instruções | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| Cobuddy | 9.8 | 10.0 | 100.0% | 0 | 11.60s | 508 | 64 | 2,842 | |
| Ling 3.0 Tiny | 6.8 | 9.4 | 50.0% | 0 | 3.10s | 744 | 618 | 1,444 |
| Resolução de quebra-cabeças | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| Cobuddy | 3.6 | 7.2 | 22.2% | 1 | 12.83s | 561 | 189 | 5,808 | |
| Ling 3.0 Tiny | 3.0 | 10.0 | 0.0% | 0 | 54.15s | 731 | 10,323 | 78,452 |
| Chamada de ferramentas | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| Cobuddy | 10.0 | 10.0 | 100.0% | 0 | 11.19s | 3,505 | 133 | 294 | |
| Ling 3.0 Tiny | 10.0 | 10.0 | 100.0% | 0 | 5.76s | 8,226 | 379 | 711 |
| Conhecimentos gerais | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| Cobuddy | 3.0 | 10.0 | 0.0% | 0 | 36.98s | 153 | 9 | 6,863 | |
| Ling 3.0 Tiny | 3.0 | 10.0 | 0.0% | 0 | 213.35s | 228 | 9,665 | 88,639 |
Comparação rápida
Trocar par de comparação
CobuddymediumDisponível grátisvsMercury 2noneCobuddymediumDisponível grátisvsGranite 4.2 8BnoneTrinity Large PreviewnoneDisponível grátisvsCobuddymediumDisponível grátisCobuddymediumDisponível grátisvsKAT Coder AIR V2.5noneCobuddymediumDisponível grátisvsNemotron 3 SupernoneDisponível grátisLing 3.0 TinyhighvsNemotron 3.5 LightningnoneDisponível grátisGranite 4.1 8bnonevsLing 3.0 TinyhighCobuddymediumDisponível grátisvsRing 2.6 1tnoneCobuddymediumDisponível grátisvsLing 2.6 FlashnoneCobuddymediumDisponível grátisvsgpt-oss-120bnoneCobuddymediumDisponível grátisvsNemotron 3.5 LightninglowDisponível grátisCobuddymediumDisponível grátisvsLaguna S 2.1lowDisponível grátis