AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Fallos por categoría de AI BENCHY

Inteligencia general: Error de API

Inteligencia general
Error de API

Mira qué modelos de IA tienen más probabilidades de caer en Error de API dentro de Inteligencia general, para detectar puntos débiles más rápido. Ordenar por: Pruebas correctas ↓.

Modelos mostrados

12

Fallos totales

12

Modelo más afectado

Nemotron 3 Ultra 550b A55b 1
Rango Modelo Empresa Cantidad de Error de API Puntuación de categoría Pruebas correctas Tiempo de respuesta (promedio)
#41 Nemotron 3 Ultra 550b A55b medium NVIDIA 1 3.7 0/1 2.52s
#72 DeepSeek V3.2 medium DeepSeek 1 3.4 0/1 58.3s
#82 Hy3 preview high Tencent 1 3.0 0/1 0ms
#89 Hy3 preview low Tencent 1 3.0 0/1 0ms
#92 Laguna M.1 medium Poolside 1 3.0 0/1 0ms
#93 Qwen3.6 Plus Preview medium Qwen 1 3.0 0/1 0ms
#107 Laguna Xs.2 medium Poolside 1 3.0 0/1 0ms
#133 DeepSeek V3.2 none DeepSeek 1 4.7 0/1 9.32s
#145 Laguna M.1 none Poolside 1 3.0 0/1 0ms
#146 Laguna Xs.2 none Poolside 1 3.0 0/1 0ms
#149 Nemotron 3 Nano Omni 30b A3b Reasoning medium NVIDIA 1 3.0 0/1 0ms
#162 Nemotron 3 Nano Omni 30b A3b Reasoning none NVIDIA 1 3.0 0/1 0ms

Mejores modelos por Cantidad de Error de API

Cantidad de Error de API vs Puntuación

Mejores modelos por Tiempo de respuesta (promedio)

Mejores modelos por Costo desperdiciado estimado