- Posição
- #70
- Total de tokens de saída
- 919,699
- Tempo de resposta (médio)
- 61.71s
- Custo total
- $0.509
Claude Haiku 5.5 (max) vs Gemini 3.1 Pro Preview (medium)
Claude Haiku 5.5 (max) lidera na pontuação média com 8.5 vs 8.4. Claude Haiku 5.5 (max) tem menor custo de benchmark com $0.509 vs $1.585. Gemini 3.1 Pro Preview (medium) é mais rápido com 22.71s vs 61.71s, com taxas de acerto de 85.5% vs 89.9%.
Modelos comparados
- Posição
- #74
- Total de tokens de saída
- 102,691
- Tempo de resposta (médio)
- 22.71s
- Custo total
- $1.585
Modelo recomendado
Claude Haiku 5.5 (max)
Tem a melhor pontuação aqui (8.5) e custa cerca de 3.1x menos que Gemini 3.1 Pro Preview (medium).
Comparação detalhada
| Métrica | Claude Haiku 5.5 Claude Haiku 5.5 max | Gemini 3.1 Pro Preview Gemini 3.1 Pro Preview medium |
|---|---|---|
| Pontuação | 8.5 | 8.4 |
| Posição | #70 | #74 |
| Confiabilidade | 10.0 | 9.8 |
| Consistência | 9.6 | 9.6 |
| Tentativas | 69/69 | 69/69 |
| Testes corretos | ||
| Taxa de acerto por tentativa | 85.5% | 89.9% |
| Testes instáveis | 1 | 1 |
| Execuções totais | 69 | 69 |
| Custo por resultado | 2.677 | 7.924 |
| Custo total | $0.509 | $1.585 |
| Preço de entrada | $0.100 / 1M | $2.000 / 1M |
| Preço de saída | $0.500 / 1M | $12.000 / 1M |
| Preço de leitura do cache | $0.010 / 1M | $0.200 / 1M |
| Preço de escrita no cache | $0.125 / 1M | $0.375 / 1M |
| Total de tokens de entrada | 487,516 | 176,208 |
| Tokens de saída | 10,212 | 6,093 |
| Tokens de raciocínio | 909,487 | 96,598 |
| Tempo de resposta (médio) | 61.71s | 22.71s |
| Tempo de resposta (máx.) | 288.94s | 88.68s |
| Tempo de resposta (total) | 1419.40s | 386.11s |
| Parâmetros | ~50B | ~1.2T no total (~20B ativos) |
| Disponibilidade | Código fechado | Código fechado |
Os preços de cache aplicam-se aos tokens de entrada. A leitura reutiliza prompts em cache; a escrita armazena-os e pode custar mais. Os tokens de saída usam o preço de saída.
Geração showcase de modelos
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#70 Claude Haiku 5.5
max
OpenRouter returned no showcase content (finish_reason: error).
- Custo
- $0.000
- Tempo
- 164.5s
- Tokens
- 0 tok
#74 Gemini 3.1 Pro Preview
medium- Custo
- $0.115
- Tempo
- 87.2s
- Tokens
- 9,629 tok
Detalhamento por categoria
| Tarefas de agentes | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 4.7 | 1.6 | 66.7% | 1 | 93.30s | 349,997 | 2,345 | 42,315 | |
| Gemini 3.1 Pro Preview | 4.7 | 1.6 | 66.7% | 1 | 56.17s | 83,912 | 861 | 4,592 |
| Truques anti-IA | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 5.52s | 858 | 401 | 10,159 | |
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 7.90s | 498 | 112 | 3,218 |
| Programação | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 55.87s | 10,608 | 532 | 125,988 | |
| Gemini 3.1 Pro Preview | 7.9 | 9.9 | 66.7% | 0 | 40.17s | 8,124 | 435 | 41,247 |
| Combinado | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 148.38s | 99,980 | 4,909 | 215,518 | |
| Gemini 3.1 Pro Preview | 9.8 | 10.0 | 100.0% | 0 | 40.39s | 67,910 | 3,687 | 23,111 |
| Análise e extração de dados | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 11.11s | 10,515 | 311 | 13,476 | |
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 7.72s | 7,265 | 279 | 3,904 |
| Específico do domínio | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 5.3 | 10.0 | 33.3% | 0 | 228.16s | 990 | 18 | 426,269 | |
| Gemini 3.1 Pro Preview | 7.7 | 10.0 | 66.7% | 0 | 20.29s | 644 | 18 | 11,704 |
| Inteligência geral | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 42.22s | 714 | 250 | 26,083 | |
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 11.77s | 490 | 108 | 1,179 |
| Seguimento de instruções | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 6.22s | 921 | 99 | 5,965 | |
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 9.56s | 621 | 72 | 2,236 |
| Resolução de quebra-cabeças | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 16.54s | 912 | 716 | 29,419 | |
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 6.90s | 570 | 235 | 3,128 |
| Chamada de ferramentas | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 9.86s | 11,757 | 355 | 3,989 | |
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 23.15s | 6,018 | 274 | 982 |
| Conhecimentos gerais | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 3.0 | 10.0 | 0.0% | 0 | 18.80s | 264 | 276 | 10,306 | |
| Gemini 3.1 Pro Preview | 10.0 | 10.0 | 100.0% | 0 | 6.27s | 156 | 12 | 1,297 |
Comparação rápida
Trocar par de comparação
Gemini 3.1 Pro PreviewmediumvsInklinghighDisponível grátisGemini 3.1 Pro PreviewmediumvsMuse Glimmer 30BxhighGemini 3.1 Pro PreviewmediumvsMuse Spark 1.1highClaude Haiku 5.5maxvsQwen3.7 MaxmediumGemini 3.1 Pro PreviewmediumvsQwen3.8 2.4T A95BlowClaude Haiku 5.5maxvsMuse Spark 1.3lowDeepSeek V4 Flash 0731highvsGemini 3.1 Pro PreviewmediumClaude Haiku 5.5maxvsGrok 4.6highClaude Haiku 5.5maxvsQwen3.8 2.4T A95BlowGemini 3.1 Pro PreviewmediumvsGLM 5.2highClaude Haiku 5.5maxvsGPT-5 MinimediumClaude Haiku 5.5maxvsMuse Glimmer 30Bxhigh