- Posição
- #242
- Total de tokens de saída
- 925,046
- Tempo de resposta (médio)
- 84.01s
- Custo total
- $0.862
Trinity Large Thinking (medium) vs Mistral Large 4 (medium)
Mistral Large 4 (medium) lidera na pontuação média com 6.2 vs 6.1. Trinity Large Thinking (medium) tem menor custo de benchmark com $0.862 vs $1.456. Trinity Large Thinking (medium) é mais rápido com 84.01s vs 265.03s, com taxas de acerto de 49.3% vs 55.1%.
Modelos comparados
- Posição
- #240
- Total de tokens de saída
- 627,233
- Tempo de resposta (médio)
- 265.03s
- Custo total
- $1.456
Modelo recomendado
Trinity Large Thinking (medium)
A pontuação fica perto da melhor aqui (6.1 vs 6.2) e custa cerca de 1.7x menos que Mistral Large 4 (medium).
Comparação detalhada
| Métrica | Trinity Large Thinking Trinity Large Thinking medium | Mistral Large 4 Mistral Large 4 medium |
|---|---|---|
| Pontuação | 6.1 | 6.2 |
| Posição | #242 | #240 |
| Confiabilidade | 10.0 | 9.2 |
| Consistência | 7.7 | 7.6 |
| Tentativas | 69/69 | 69/69 |
| Testes corretos | ||
| Taxa de acerto por tentativa | 49.3% | 55.1% |
| Testes instáveis | 7 | 7 |
| Execuções totais | 69 | 69 |
| Custo por resultado | 10.772 | 16.168 |
| Custo total | $0.862 | $1.456 |
| Preço de entrada | $0.250 / 1M | $0.680 / 1M |
| Preço de saída | $0.800 / 1M | $2.090 / 1M |
| Preço de leitura do cache | $0.060 / 1M | $0.070 / 1M |
| Preço de escrita no cache | N/D | N/D |
| Total de tokens de entrada | 319,352 | 212,024 |
| Tokens de saída | 158,447 | 166,422 |
| Tokens de raciocínio | 875,524 | 562,095 |
| Tempo de resposta (médio) | 84.01s | 265.03s |
| Tempo de resposta (máx.) | 525.14s | 1760.20s |
| Tempo de resposta (total) | 1932.24s | 6095.69s |
| Parâmetros | 398B no total (13B ativos) | 1.05T no total (49B ativos) |
| Disponibilidade | Pesos disponíveis | Código fechado |
Os preços de cache aplicam-se aos tokens de entrada. A leitura reutiliza prompts em cache; a escrita armazena-os e pode custar mais. Os tokens de saída usam o preço de saída.
Geração showcase de modelos
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#242 Trinity Large Thinking
medium- Custo
- $0.016
- Tempo
- 75.9s
- Tokens
- 19,401 tok
#240 Mistral Large 4
medium- Custo
- $0.011
- Tempo
- 63.4s
- Tokens
- 5,291 tok
Melhores modelos por pontuação
Pontuação vs custo total
Tempo de resposta (médio)
Pontuação vs Tempo de resposta (médio)
Total de tokens de saída
Pontuação vs Total de tokens de saída
Detalhamento por categoria
| Tarefas de agentes | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 6.1 | 3.1 | 66.7% | 1 | 52.50s | 200,866 | 2,281 | 14,905 | |
| Mistral Large 4 | 6.1 | 3.1 | 66.7% | 1 | 173.21s | 135,844 | 7,482 | 13,709 |
| Truques anti-IA | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 6.8 | 9.8 | 50.0% | 0 | 5.11s | 663 | 1,531 | 6,078 | |
| Mistral Large 4 | 8.3 | 10.0 | 75.0% | 0 | 15.73s | 705 | 1,087 | 7,308 |
| Programação | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 7.5 | 10.0 | 66.7% | 0 | 179.02s | 7,248 | 7,413 | 351,155 | |
| Mistral Large 4 | 3.4 | 7.2 | 22.2% | 1 | 1201.87s | 7,189 | 33,530 | 303,140 |
| Combinado | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 2.9 | 6.0 | 16.7% | 1 | 382.70s | 93,292 | 35,814 | 269,745 | |
| Mistral Large 4 | 7.3 | 5.8 | 83.3% | 1 | 510.65s | 51,756 | 8,436 | 82,002 |
| Análise e extração de dados | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 6.3 | 5.8 | 66.7% | 1 | 16.38s | 6,906 | 475 | 11,153 | |
| Mistral Large 4 | 10.0 | 10.0 | 100.0% | 0 | 25.95s | 7,314 | 1,046 | 7,861 |
| Específico do domínio | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 5.3 | 7.2 | 44.4% | 1 | 124.17s | 756 | 99,334 | 172,018 | |
| Mistral Large 4 | 2.9 | 7.2 | 11.1% | 1 | 288.04s | 798 | 85,691 | 114,373 |
| Inteligência geral | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 10.0 | 10.0 | 100.0% | 0 | 32.22s | 501 | 7,035 | 7,774 | |
| Mistral Large 4 | 3.5 | 2.2 | 33.3% | 1 | 39.33s | 516 | 4,704 | 4,909 |
| Seguimento de instruções | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 4.4 | 6.9 | 16.7% | 1 | 3.99s | 684 | 77 | 3,798 | |
| Mistral Large 4 | 8.3 | 10.0 | 50.0% | 0 | 24.62s | 708 | 6,709 | 7,691 |
| Resolução de quebra-cabeças | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 5.2 | 5.4 | 44.5% | 2 | 2.90s | 678 | 2,508 | 3,231 | |
| Mistral Large 4 | 6.1 | 4.7 | 66.7% | 2 | 41.40s | 717 | 8,254 | 10,519 |
| Chamada de ferramentas | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 10.0 | 10.0 | 100.0% | 0 | 5.26s | 7,551 | 299 | 1,372 | |
| Mistral Large 4 | 10.0 | 10.0 | 100.0% | 0 | 19.19s | 6,267 | 303 | 1,104 |
| Conhecimentos gerais | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 3.0 | 10.0 | 0.0% | 0 | 97.44s | 207 | 1,680 | 34,295 | |
| Mistral Large 4 | 3.0 | 10.0 | 0.0% | 0 | 84.68s | 210 | 9,180 | 9,479 |
Comparação rápida
Trocar par de comparação
Apodex 1.1 MinilowDisponível grátisvsTrinity Large ThinkingmediumTrinity Large ThinkingmediumvsInklingnoneDisponível grátisTrinity Large ThinkingmediumvsQwen3.5 Plus 2026-04-20noneClaude Fable 5.1lowvsMistral Large 4mediumTrinity Large ThinkingmediumvsGemini 3.5 FlashnoneGemini 3.5 FlashnonevsMistral Large 4mediumGemini 3.1 Flash Lite PreviewnonevsMistral Large 4mediumTrinity Large ThinkingmediumvsKAT-Coder-Pro V2.5defaultDeepSeek V4 Flash 0731nonevsMistral Large 4mediumApodex 1.1 MinilowDisponível grátisvsMistral Large 4mediumMistral Large 4mediumvsInklingnoneDisponível grátisMistral Large 4mediumvsQwen3.5 Plus 2026-04-20none