Categoria AI BENCHY
Ranking de Específico do domínio
Veja quais modelos de IA vão melhor em Específico do domínio, quais permanecem confiáveis e onde aparecem as maiores diferenças.
Modelos exibidos
15
Média de Pontuação de Específico do domínio
4.7
Melhor modelo
Gemini 3 Flash Preview 10.0
197/197
Filtrar modelos
Nenhum modelo corresponde à pesquisa e aos filtros atuais.
| Posição | Modelo | Empresa | Pontuação de Específico do domínio | Pontuação | Custo total | Testes corretos | Tempo de resposta (médio) |
|---|---|---|---|---|---|---|---|
| #120 | Gemma 4 31B none | 7.7 | 6.1 | $0.002 | 2/3 | 3.22s | |
| #122 | Qwen3.6 Max Preview none | Qwen | 7.7 | 6.0 | $0.075 | 2/3 | 1.22s |
| #127 | Qwen3.5-35B-A3B none | Qwen | 7.7 | 5.9 | $0.012 | 2/3 | 485ms |
| #145 | Qwen3.6 27B none | Qwen | 7.7 | 5.5 | $0.025 | 2/3 | 3.03s |
| #169 | GLM 4.7 Flash none | Z.ai | 7.7 | 4.9 | $0.004 | 2/3 | 744ms |
| #1 | Gemini 3.5 Flash high | 7.6 | 9.8 | $1.115 | 2/3 | 14.1s | |
| #83 | Gemini 3.5 Flash none | 7.6 | 7.0 | $1.079 | 2/3 | 10.6s | |
| #4 | Qwen3.7 Max medium | Qwen | 5.9 | 9.4 | $0.523 | 1/3 | 24.9s |
| #5 | GPT-5.6 Sol medium | OpenAI | 5.9 | 9.4 | $0.966 | 1/3 | 47.9s |
| #13 | GPT-5.3-Codex medium | OpenAI | 5.9 | 8.9 | $0.740 | 1/3 | 64.3s |
| #21 | Seed-2.0-Lite medium | Bytedance Seed | 5.9 | 8.5 | $0.175 | 1/3 | 88.7s |
| #25 | GPT-5.2 medium | OpenAI | 5.9 | 8.4 | $0.548 | 1/3 | 77.8s |
| #28 | Gemini 2.5 Flash medium | 5.9 | 8.2 | $0.379 | 1/3 | 37.3s | |
| #62 | GPT-5.4 Nano medium | OpenAI | 5.9 | 7.5 | $0.107 | 1/3 | 38.2s |
| #78 | MiMo-V2-Flash medium | Xiaomi | 5.9 | 7.1 | $0.043 | 1/3 | 96.0s |