- Posição
- #78
- Total de tokens de saída
- 233,327
- Tempo de resposta (médio)
- 139.41s
- Custo total
- $4.013
Kimi K3 (max) vs Grok 4.5 (high)
Kimi K3 (max) lidera na pontuação média com 8.3 vs 8.2. Grok 4.5 (high) tem menor custo de benchmark com $2.571 vs $4.013. Grok 4.5 (high) é mais rápido com 72.50s vs 139.41s, com taxas de acerto de 78.3% vs 82.6%.
Modelos comparados
- Posição
- #82
- Total de tokens de saída
- 333,632
- Tempo de resposta (médio)
- 72.50s
- Custo total
- $2.571
Modelo recomendado
Grok 4.5 (high)
A pontuação fica perto da melhor aqui (8.2 vs 8.3) e custa cerca de 1.6x menos que Kimi K3 (max).
Comparação detalhada
| Métrica | Kimi K3 Kimi K3 max | Grok 4.5 Grok 4.5 high |
|---|---|---|
| Pontuação | 8.3 | 8.2 |
| Posição | #78 | #82 |
| Confiabilidade | 9.3 | 10.0 |
| Consistência | 9.3 | 8.9 |
| Tentativas | 69/69 | 69/69 |
| Testes corretos | ||
| Taxa de acerto por tentativa | 78.3% | 82.6% |
| Testes instáveis | 2 | 3 |
| Execuções totais | 69 | 69 |
| Custo por resultado | 23.601 | 15.123 |
| Custo total | $4.013 | $2.571 |
| Preço de entrada | $3.000 / 1M | $2.000 / 1M |
| Preço de saída | $15.000 / 1M | $6.000 / 1M |
| Total de tokens de entrada | 170,700 | 342,124 |
| Tokens de saída | 7,719 | 7,135 |
| Tokens de raciocínio | 225,608 | 326,497 |
| Tempo de resposta (médio) | 139.41s | 72.50s |
| Tempo de resposta (máx.) | 766.58s | 676.83s |
| Tempo de resposta (total) | 2788.26s | 1667.51s |
| Parâmetros | 2.8T no total (104B ativos) | ~1.7T no total (~170B ativos) |
| Disponibilidade | Pesos disponíveis | Código fechado |
Geração showcase de modelos
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#78 MoonshotAI: Kimi K3
max- Custo
- $0.281
- Tempo
- 506.9s
- Tokens
- 18,863 tok
#82 SpaceXAI: Grok 4.5
high- Custo
- $0.015
- Tempo
- 29.7s
- Tokens
- 2,737 tok
Melhores modelos por pontuação
Pontuação vs custo total
Tempo de resposta (médio)
Pontuação vs Tempo de resposta (médio)
Total de tokens de saída
Pontuação vs Total de tokens de saída
Detalhamento por categoria
Comparação rápida
Trocar par de comparação
Gemini 3.5 FlashhighvsKimi K3maxGrok 4.5highvsGLM 5.2mediumQwen3.7 PlusmediumvsGrok 4.5highGPT-5.6 TerramediumvsGrok 4.5highClaude Opus 4.8mediumvsGrok 4.5highGPT-6 LunamediumvsGrok 4.5highKimi K3maxvsGPT-5.6 TerrahighKimi K3maxvsGPT-6 LunamediumClaude Opus 4.8mediumvsKimi K3maxKimi K3maxvsQwen3.7 PlusmediumKimi K3maxvsGLM 5.2highKimi K3maxvsGLM 5.2medium