AI BENCHY
Advertise here

Categoría AI BENCHY

Ranking de Cultura general

Mira qué modelos de IA rinden mejor en Cultura general, cuáles se mantienen fiables y dónde aparecen las mayores diferencias. Ordenar por: Pruebas correctas ↑.

Modelos mostrados

11

Promedio de Puntuación de Cultura general

2.9

Rango Modelo Empresa Puntuación de Cultura general Puntuación Pruebas correctas Tiempo de respuesta (promedio)
#134 Nemotron 3 Nano Omni 30b A3b Reasoning none NVIDIA 0.0 4.6 0/0 0ms
#135 GPT-5.4 Nano none OpenAI 3.0 4.5 0/1 773ms
#136 GLM 4.7 Flash medium Z.ai 3.0 4.5 0/1 11.1s
#137 MiMo-V2-Flash none Xiaomi 3.0 4.5 0/1 1.82s
#138 Ling-2.6-1T none Inclusionai 0.0 4.5 0/0 0ms
#139 Grok 4.1 Fast none X AI 3.0 4.4 0/1 731ms
#140 Qwen3.5-9B medium Qwen 3.0 4.3 0/1 177.0s
#142 Granite 4.1 8B none IBM Granite 3.0 4.1 0/1 306ms
#1 Gemini 3 Flash Preview medium Google 10.0 10.0 1/1 5.50s
#2 Gemini 3.1 Pro Preview medium Google 10.0 9.6 1/1 6.27s
#7 Gemini 3 Flash Preview low Google 10.0 8.8 1/1 2.75s

Mejores modelos por Puntuación de Cultura general

Puntuación de Cultura general vs costo total

Mejores modelos por Tiempo de respuesta (promedio)