AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Fallos por categoría de AI BENCHY

Análisis y extracción de datos: Error de API

Análisis y extracción de datos
Error de API

Mira qué modelos de IA tienen más probabilidades de caer en Error de API dentro de Análisis y extracción de datos, para detectar puntos débiles más rápido. Ordenar por: Pruebas correctas ↓.

Modelos mostrados

6

Fallos totales

6

Modelo más afectado

Qwen3.5-Flash 1
Rango Modelo Empresa Cantidad de Error de API Puntuación de categoría Pruebas correctas Tiempo de respuesta (promedio)
#32 Qwen3.5-Flash medium Qwen 1 7.3 1/2 57.0s
#41 MiMo-V2-Flash medium Xiaomi 1 6.5 1/2 0ms
#43 Qwen3.5-35B-A3B medium Qwen 1 7.3 1/2 59.3s
#73 Mistral Small 4 medium Mistral 1 7.3 1/2 1.23s
#84 gpt-oss-120b none OpenAI 1 6.5 1/2 7.12s
#94 MiMo-V2-Flash none Xiaomi 1 2.9 0/2 19.7s

Mejores modelos por Cantidad de Error de API

Cantidad de Error de API vs Puntuación

Mejores modelos por Tiempo de respuesta (promedio)

Mejores modelos por Costo desperdiciado estimado