Ranking de Inteligencia general
Mira qué modelos de IA rinden mejor en Inteligencia general, cuáles se mantienen fiables y dónde aparecen las mayores diferencias. Ordenar por: Costo total ↑.
Modelos mostrados
15
Promedio de Puntuación de Inteligencia general
6.1
Mejor modelo
North Mini Code 5.1
216/216
Filtrar modelos
Ningún modelo coincide con la búsqueda y los filtros actuales.
| Rango | Modelo | Empresa | Puntuación de Inteligencia general | Puntuación | Costo total | Pruebas correctas | Tiempo de respuesta (promedio) |
|---|---|---|---|---|---|---|---|
| #208 | Grok Build 0.1 none | X AI | 4.3 | 4.0 | $0.547 | 0/1 | 12.5s |
| #118 | Claude Sonnet 5 none | Anthropic | 4.7 | 6.3 | $0.548 | 0/1 | 2.81s |
| #58 | GPT-5.3 Chat none | OpenAI | 4.6 | 7.5 | $0.571 | 0/1 | 1.99s |
| #31 | Gemini 3.5 Flash-Lite high | 5.4 | 8.1 | $0.584 | 0/1 | 3.40s | |
| #81 | Kimi K2.5 medium | Moonshot AI | 6.5 | 7.0 | $0.600 | 0/1 | 69.7s |
| #34 | GPT-5.2 Chat none | OpenAI | 4.4 | 8.0 | $0.604 | 0/1 | 3.20s |
| #111 | Gemini 3.1 Flash Lite low | 4.0 | 6.5 | $0.621 | 0/1 | 1.37s | |
| #12 | Gemini 3.5 Flash medium | 10.0 | 9.1 | $0.642 | 1/1 | 2.52s | |
| #28 | Gemini 2.5 Flash medium | 4.8 | 8.2 | $0.643 | 0/1 | 4.86s | |
| #110 | Gemini 3.1 Flash Lite Preview low | 4.0 | 6.5 | $0.646 | 0/1 | 1.54s | |
| #27 | Muse Spark 1.1 low | Meta | 10.0 | 8.3 | $0.647 | 1/1 | 4.12s |
| #67 | Claude Sonnet 4.6 none | Anthropic | 6.1 | 7.3 | $0.661 | 0/1 | 2.56s |
| #43 | GPT-5.6 Terra medium | OpenAI | 5.5 | 7.8 | $0.676 | 0/1 | 2.37s |
| #140 | Mimo V2 Omni medium | Xiaomi | 5.4 | 5.9 | $0.683 | 0/1 | 3.61s |
| #89 | Qwen3.6 Flash medium | Qwen | 4.8 | 6.9 | $0.738 | 0/1 | 9.88s |