Ranking de Cultura general
Mira qué modelos de IA rinden mejor en Cultura general, cuáles se mantienen fiables y dónde aparecen las mayores diferencias. Ordenar por: Tiempo de respuesta (promedio) ↓.
364/364
Filtrar modelos
Ningún modelo coincide con la búsqueda y los filtros actuales.
| Rango | Modelo | Empresa | Puntuación de Cultura general | Puntuación | Costo total | Pruebas correctas | Tiempo de respuesta (promedio) |
|---|---|---|---|---|---|---|---|
| #45 | Claude Opus 4.8 medium | Anthropic | 3.0 | 8.8 | $1.983 | 0/1 | 6.14s |
| #16 | GPT-6 Astra medium | OpenAI | 2.8 | 9.4 | $1.774 | 0/1 | 5.98s |
| #118 | GPT-5.6 Terra low | OpenAI | 3.0 | 7.5 | $0.420 | 0/1 | 5.95s |
| #26 | Gemini 3.8 Flash medium | 10.0 | 9.1 | $0.653 | 1/1 | 5.94s | |
| #297 | Mistral Small 4 medium | Mistral | 3.0 | 5.1 | $0.097 | 0/1 | 5.92s |
| #5 | GPT-6 Astra high | OpenAI | 10.0 | 9.9 | $3.474 | 1/1 | 5.83s |
| #180 | DeepSeek V4 Pro none | DeepSeek | 3.0 | 6.8 | $0.206 | 0/1 | 5.76s |
| #7 | Gemini 3.7 Flash high | 10.0 | 9.8 | $0.646 | 1/1 | 5.60s | |
| #298 | Granite 4.2 8B low | IBM Granite | 3.0 | 5.1 | $0.012 | 0/1 | 5.53s |
| #11 | Gemini 3 Flash Preview medium | 10.0 | 9.5 | $0.763 | 1/1 | 5.50s | |
| #103 | Claude Opus 4.8 low | Anthropic | 3.0 | 7.8 | $2.089 | 0/1 | 5.48s |
| #156 | Mercury 2.5 high | Inception | 3.0 | 7.1 | $0.031 | 0/1 | 5.48s |
| #8 | Gemini 3.6 Flash medium | 10.0 | 9.8 | $0.427 | 1/1 | 5.48s | |
| #199 | Mercury 2.5 Preview high | Inception | 3.0 | 6.6 | $0.030 | 0/1 | 5.41s |
| #288 | Seed-2.0-Code none | Bytedance Seed | 3.0 | 5.3 | $0.151 | 0/1 | 5.36s |