Navegación
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Cobuddy vs Qwen: Qwen3.5-122B-A10B

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-05-19

Métrica Cobuddy Cobuddy medium Lanzamiento: 2026-05-06 Disponible gratis Qwen3.5-122B-A10B Qwen3.5-122B-A10B none Lanzamiento: 2026-02-24
Puntuación 5.8 5.5
Rango #102 #117
Fiabilidad 9.9 10.0
Consistencia 6.9 9.2
Pruebas correctas
Tasa de aciertos por intento 54.4% 36.8%
Pruebas inestables 7 2
Ejecuciones totales 57 57
Costo por resultado 0.000 0.361
Costo total $0.000 $0.022
Precio de entrada $0.000 / 1M $0.260 / 1M
Precio de salida $0.000 / 1M $2.080 / 1M
Tokens de salida 1,648 3,350
Tokens de razonamiento 96,062 0
Tiempo de respuesta (promedio) 36.50s 3.52s
Tiempo de respuesta (máximo) 309.02s 46.00s
Tiempo de respuesta (total) 693.45s 66.80s

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Trucos anti-IA Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Cobuddy 8.7 7.9 91.7% 1 10.00s 98 4,666
Qwen3.5-122B-A10B 4.8 10.0 25.0% 0 1.59s 312 0
Programación Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Cobuddy 4.3 1.1 66.7% 1 53.59s 343 9,678
Qwen3.5-122B-A10B 4.3 1.1 66.7% 1 3.44s 659 0
Combinado Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Cobuddy 3.0 10.0 0.0% 0 47.38s 465 7,265
Qwen3.5-122B-A10B 3.0 10.0 0.0% 0 46.00s 1,137 0
Análisis y extracción de datos Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Cobuddy 6.3 5.8 66.7% 1 17.36s 275 5,591
Qwen3.5-122B-A10B 10.0 10.0 100.0% 0 1.01s 243 0
Específico del dominio Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Cobuddy 2.9 4.4 22.2% 2 128.15s 10 49,454
Qwen3.5-122B-A10B 5.3 10.0 33.3% 0 465ms 15 0
Inteligencia general Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Cobuddy 4.2 9.9 0.0% 0 23.23s 76 3,782
Qwen3.5-122B-A10B 5.0 10.0 0.0% 0 1.12s 66 0
Seguimiento de instrucciones Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Cobuddy 9.8 10.0 100.0% 0 11.60s 64 2,842
Qwen3.5-122B-A10B 6.3 10.0 50.0% 0 585ms 70 0
Resolución de acertijos Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Cobuddy 3.5 4.4 33.3% 2 12.91s 175 5,627
Qwen3.5-122B-A10B 3.7 7.7 11.1% 1 982ms 575 0
Llamada de herramientas Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Cobuddy 10.0 10.0 100.0% 0 11.19s 133 294
Qwen3.5-122B-A10B 10.0 10.0 100.0% 0 2.04s 264 0
Cultura general Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Cobuddy 3.0 10.0 0.0% 0 36.98s 9 6,863
Qwen3.5-122B-A10B 3.0 10.0 0.0% 0 295ms 9 0

Comparación rápida

Cambiar par de comparación