Categoria AI BENCHY
Ranking de Específico do domínio
Veja quais modelos de IA vão melhor em Específico do domínio, quais permanecem confiáveis e onde aparecem as maiores diferenças. Ordenar por: Tempo de resposta (médio) ↑.
197/197
Filtrar modelos
Nenhum modelo corresponde à pesquisa e aos filtros atuais.
| Posição | Modelo | Empresa | Pontuação de Específico do domínio | Pontuação | Custo total | Testes corretos | Tempo de resposta (médio) |
|---|---|---|---|---|---|---|---|
| #18 | GLM 5 medium | Z.ai | 3.5 | 8.6 | $0.228 | 0/3 | 0ms |
| #40 | Claude Sonnet 4.6 medium | Anthropic | 2.9 | 7.8 | $1.418 | 0/3 | 0ms |
| #66 | Seed-2.0-Mini medium | Bytedance Seed | 3.0 | 7.4 | $0.044 | 0/3 | 0ms |
| #197 | LFM2-24B-A2B none | Liquid | 5.9 | 2.4 | $0.001 | 1/3 | 287ms |
| #191 | Granite 4.1 8B none | IBM Granite | 3.0 | 4.0 | $0.003 | 0/3 | 357ms |
| #149 | Laguna XS 2.1 none | Poolside | 5.3 | 5.3 | $0.003 | 1/3 | 364ms |
| #156 | Mistral Small 4 none | Mistral | 5.3 | 5.1 | $0.007 | 1/3 | 367ms |
| #190 | Laguna Xs.2 none | Poolside | 5.3 | 4.0 | $0.004 | 1/3 | 371ms |
| #162 | Qwen3.5-9B none | Qwen | 3.0 | 5.1 | $0.006 | 0/3 | 464ms |
| #152 | Qwen3.5-122B-A10B none | Qwen | 5.3 | 5.3 | $0.020 | 1/3 | 465ms |
| #127 | Qwen3.5-35B-A3B none | Qwen | 7.7 | 5.9 | $0.012 | 2/3 | 485ms |
| #195 | Nemotron 3 Nano Omni 30b A3b Reasoning none | NVIDIA | 3.6 | 3.5 | $0.000 | 0/3 | 489ms |
| #114 | Gemini 2.5 Flash none | 5.9 | 6.2 | $0.016 | 1/3 | 495ms | |
| #179 | Mercury 2 none | Inception | 5.3 | 4.6 | $0.011 | 1/3 | 534ms |
| #128 | Qwen3.5-27B none | Qwen | 3.0 | 5.9 | $0.015 | 0/3 | 540ms |