Ranking de Cultura general
Mira qué modelos de IA rinden mejor en Cultura general, cuáles se mantienen fiables y dónde aparecen las mayores diferencias. Ordenar por: Pruebas correctas ↓.
Modelos mostrados
15
Promedio de Puntuación de Cultura general
3.2
Mejor modelo
Gemini 3.6 Flash 10.0
250/250
Filtrar modelos
Ningún modelo coincide con la búsqueda y los filtros actuales.
| Rango | Modelo | Empresa | Puntuación de Cultura general | Puntuación | Costo total | Pruebas correctas | Tiempo de respuesta (promedio) |
|---|---|---|---|---|---|---|---|
| #60 | Claude Opus 4.6 medium | Anthropic | 3.0 | 7.7 | $3.059 | 0/1 | 63.2s |
| #61 | GPT-5.6 Luna high | OpenAI | 3.0 | 7.7 | $0.102 | 0/1 | 17.0s |
| #62 | DeepSeek V4 Flash high | DeepSeek | 3.0 | 7.7 | $0.060 | 0/1 | 54.5s |
| #63 | DeepSeek V4 Pro high | DeepSeek | 3.0 | 7.7 | $0.200 | 0/1 | 34.0s |
| #64 | MiniMax M3 medium | Minimax | 3.0 | 7.6 | $0.286 | 0/1 | 100.8s |
| #65 | Grok Build 0.1 medium | X AI | 3.0 | 7.6 | $1.097 | 0/1 | 53.5s |
| #66 | GLM 5 Turbo medium | Z.ai | 3.0 | 7.6 | $0.323 | 0/1 | 40.2s |
| #67 | GPT-5.6 Luna medium | OpenAI | 3.0 | 7.6 | $0.036 | 0/1 | 6.64s |
| #68 | Nemotron 3 Ultra medium | NVIDIA | 3.0 | 7.5 | $0.774 | 0/1 | 38.5s |
| #69 | Claude Opus 5 none | Anthropic | 3.0 | 7.5 | $1.550 | 0/1 | 4.08s |
| #70 | Kimi K2.7 Code medium | Moonshot AI | 3.0 | 7.5 | $0.686 | 0/1 | 341.8s |
| #71 | GPT-5.4 Nano medium | OpenAI | 3.0 | 7.5 | $0.138 | 0/1 | 4.81s |
| #72 | GPT-5.3 Chat none | OpenAI | 3.0 | 7.5 | $0.571 | 0/1 | 4.38s |
| #73 | GPT-5.6 Terra low | OpenAI | 3.0 | 7.5 | $0.208 | 0/1 | 5.95s |
| #74 | GPT-5.4 Mini medium | OpenAI | 3.0 | 7.5 | $0.756 | 0/1 | 30.1s |