AI BENCHY
Advertise here

Fallos por categoría de AI BENCHY

Combinado: Respuesta incorrecta

Combinado
Respuesta incorrecta

Mira qué modelos de IA tienen más probabilidades de caer en Respuesta incorrecta dentro de Combinado, para detectar puntos débiles más rápido.

Modelos mostrados

7

Fallos totales

52

Modelo más afectado

Gemini 3 Flash Preview 1
Rango Modelo Empresa Cantidad de Respuesta incorrecta Puntuación de categoría Pruebas correctas Tiempo de respuesta (promedio)
#150 Qwen3 Coder Next medium Qwen 1 3.0 0/1 4.28s
#151 Trinity Large Preview none Arcee AI 1 3.0 0/1 8.91s
#152 MiMo-V2-Flash none Xiaomi 1 3.0 0/1 2.87s
#155 Mercury 2 none Inception 1 3.0 0/1 606ms
#156 Hy3 preview none Tencent 1 3.0 0/1 35.8s
#157 Grok 4.1 Fast none X AI 1 3.0 0/1 3.33s
#159 Ling-2.6-1T none Inclusionai 1 3.0 0/1 23.5s

Mejores modelos por Cantidad de Respuesta incorrecta

Cantidad de Respuesta incorrecta vs Puntuación

Mejores modelos por Tiempo de respuesta (promedio)

Mejores modelos por Costo desperdiciado estimado