Ranking de Cultura general
Mira qué modelos de IA rinden mejor en Cultura general, cuáles se mantienen fiables y dónde aparecen las mayores diferencias. Ordenar por: Costo total ↑.
Modelos mostrados
15
Promedio de Puntuación de Cultura general
3.3
Mejor modelo
Space Bunny Alpha 3.0
364/364
Filtrar modelos
Ningún modelo coincide con la búsqueda y los filtros actuales.
| Rango | Modelo | Empresa | Puntuación de Cultura general | Puntuación | Costo total | Pruebas correctas | Tiempo de respuesta (promedio) |
|---|---|---|---|---|---|---|---|
| #193 | Gemini 3.5 Flash Lite low | 4.7 | 6.6 | $0.138 | 0/1 | 1.65s | |
| #155 | Solar Pro 4 high | Upstage | 3.0 | 7.1 | $0.138 | 0/1 | 81.1s |
| #84 | DeepSeek V4 Flash 0731 low | DeepSeek | 3.0 | 8.0 | $0.138 | 0/1 | 246.9s |
| #316 | Nemotron 3.5 Lightning low | NVIDIA | 3.0 | 4.8 | $0.140 | 0/1 | 38.7s |
| #179 | Solar Pro 4 medium | Upstage | 3.0 | 6.8 | $0.140 | 0/1 | 108.6s |
| #228 | Qwen3.5-Flash medium | Qwen | 3.0 | 6.1 | $0.142 | 0/1 | 49.0s |
| #117 | GPT-5.4 Nano medium | OpenAI | 3.0 | 7.5 | $0.142 | 0/1 | 4.81s |
| #293 | Inkling none | Thinkingmachines | 3.0 | 5.2 | $0.147 | 0/1 | 670ms |
| #113 | Solar Pro 4 xhigh | Upstage | 3.0 | 7.6 | $0.150 | 0/1 | 119.9s |
| #288 | Seed-2.0-Code none | Bytedance Seed | 3.0 | 5.3 | $0.151 | 0/1 | 5.36s |
| #98 | GLM 5.2 medium | Z.ai | 3.0 | 7.8 | $0.151 | 0/1 | 34.2s |
| #242 | Qwen3.5-35B-A3B none | Qwen | 3.0 | 5.9 | $0.151 | 0/1 | 493ms |
| #153 | Muse Glimmer 30B low | Meta | 3.0 | 7.1 | $0.152 | 0/1 | 9.71s |
| #181 | GLM 5.3 low | Z.ai | 3.0 | 6.8 | $0.154 | 0/1 | 7.42s |
| #295 | Nemotron 3.5 Lightning medium | NVIDIA | 3.0 | 5.1 | $0.156 | 0/1 | 44.0s |