Ranking de Cultura general
Mira qué modelos de IA rinden mejor en Cultura general, cuáles se mantienen fiables y dónde aparecen las mayores diferencias. Ordenar por: Costo total ↓.
Modelos mostrados
15
Promedio de Puntuación de Cultura general
3.3
Mejor modelo
Grok 4.20 Multi Agent Beta 0.0
364/364
Filtrar modelos
Ningún modelo coincide con la búsqueda y los filtros actuales.
| Rango | Modelo | Empresa | Puntuación de Cultura general | Puntuación | Costo total | Pruebas correctas | Tiempo de respuesta (promedio) |
|---|---|---|---|---|---|---|---|
| #110 | MiMo-V2.6-Flash low | Xiaomi | 3.0 | 7.6 | $0.174 | 0/1 | 154.4s |
| #335 | GLM 4.7 Flash medium | Z.ai | 3.0 | 4.3 | $0.168 | 0/1 | 11.1s |
| #258 | GLM 5.1 none | Z.ai | 3.0 | 5.7 | $0.164 | 0/1 | 2.34s |
| #57 | DeepSeek V4.1 Flash low | DeepSeek | 3.0 | 8.5 | $0.161 | 0/1 | 46.9s |
| #295 | Nemotron 3.5 Lightning medium | NVIDIA | 3.0 | 5.1 | $0.156 | 0/1 | 44.0s |
| #181 | GLM 5.3 low | Z.ai | 3.0 | 6.8 | $0.154 | 0/1 | 7.42s |
| #153 | Muse Glimmer 30B low | Meta | 3.0 | 7.1 | $0.152 | 0/1 | 9.71s |
| #242 | Qwen3.5-35B-A3B none | Qwen | 3.0 | 5.9 | $0.151 | 0/1 | 493ms |
| #98 | GLM 5.2 medium | Z.ai | 3.0 | 7.8 | $0.151 | 0/1 | 34.2s |
| #288 | Seed-2.0-Code none | Bytedance Seed | 3.0 | 5.3 | $0.151 | 0/1 | 5.36s |
| #113 | Solar Pro 4 xhigh | Upstage | 3.0 | 7.6 | $0.150 | 0/1 | 119.9s |
| #293 | Inkling none | Thinkingmachines | 3.0 | 5.2 | $0.147 | 0/1 | 670ms |
| #117 | GPT-5.4 Nano medium | OpenAI | 3.0 | 7.5 | $0.142 | 0/1 | 4.81s |
| #228 | Qwen3.5-Flash medium | Qwen | 3.0 | 6.1 | $0.142 | 0/1 | 49.0s |
| #179 | Solar Pro 4 medium | Upstage | 3.0 | 6.8 | $0.140 | 0/1 | 108.6s |