AI BENCHY Compare

inclusionAI: Ring-2.6-1T vs Hunter Alpha

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-05-22

Métrica	Ring-2.6-1T Ring-2.6-1T medium Lanzamiento: 2026-05-10	Hunter Alpha Hunter Alpha none Lanzamiento: 2026-03-11

Métrica	Ring-2.6-1T Ring-2.6-1T medium Lanzamiento: 2026-05-10	Hunter Alpha Hunter Alpha none Lanzamiento: 2026-03-11
Puntuación	7.2	5.7
Rango	#61	#108
Fiabilidad	9.9	N/D
Consistencia	8.7	8.2
Pruebas correctas
Tasa de aciertos por intento	66.7%	46.3%
Pruebas inestables	3	4
Ejecuciones totales	60	52
Costo por resultado	0.000	0.000
Costo total	$0.000	$0.000
Precio de entrada	$0.075 / 1M	$0.000 / 1M
Precio de salida	$0.625 / 1M	$0.000 / 1M
Tokens de salida	21,752	2,278
Tokens de razonamiento	42,754	0
Tiempo de respuesta (promedio)	61.29s	4.58s
Tiempo de respuesta (máximo)	304.19s	15.17s
Tiempo de respuesta (total)	1164.50s	77.92s

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Trucos anti-IA	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Ring-2.6-1T	10.0	10.0	100.0%	0		42.21s	3,833	4,891
Hunter Alpha	3.5	8.0	16.7%	1		3.81s	779	0

Programación	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Ring-2.6-1T	10.0	10.0	100.0%	0		59.65s	1,369	3,985
Hunter Alpha	3.0	10.0	0.0%	0		0ms	0	0

Combinado	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Ring-2.6-1T	10.0	10.0	100.0%	0		304.19s	324	6,088
Hunter Alpha	3.0	10.0	0.0%	0		15.17s	379	0

Análisis y extracción de datos	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Ring-2.6-1T	6.5	10.0	50.0%	0		37.36s	840	1,937
Hunter Alpha	10.0	10.0	100.0%	0		8.49s	249	0

Específico del dominio	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Ring-2.6-1T	3.5	4.4	33.3%	2		64.92s	9,744	15,013
Hunter Alpha	5.3	10.0	33.3%	0		2.33s	27	0

Inteligencia general	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Ring-2.6-1T	4.1	10.0	0.0%	0		58.26s	150	583
Hunter Alpha	6.1	3.1	66.7%	1		2.71s	91	0

Seguimiento de instrucciones	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Ring-2.6-1T	9.8	10.0	100.0%	0		11.78s	266	1,831
Hunter Alpha	6.4	10.0	50.0%	0		2.82s	69	0

Resolución de acertijos	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Ring-2.6-1T	5.9	7.2	55.6%	1		20.73s	697	2,479
Hunter Alpha	5.8	4.4	66.7%	2		3.06s	349	0

Llamada de herramientas	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Ring-2.6-1T	10.0	10.0	100.0%	0		104.44s	234	1,531
Hunter Alpha	10.0	10.0	100.0%	0		6.02s	335	0

Cultura general	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Ring-2.6-1T	3.0	10.0	0.0%	0		113.91s	4,295	4,416
Hunter Alpha	-	-	-	-	-	-	-	-

Comparación rápida

Cambiar par de comparación

Ring-2.6-1TmediumvsQwen3.6 Max Previewnone DeepSeek V4 FlashhighDisponible gratisvsRing-2.6-1Tmedium Ring-2.6-1TmediumvsGPT-5.3 Chatnone Gemini 3.1 Flash LitelowvsRing-2.6-1Tmedium Claude Sonnet 4.6nonevsRing-2.6-1Tmedium Gemini 3.1 Flash Lite PreviewnonevsRing-2.6-1Tmedium Ring-2.6-1TmediumvsGPT-5.2 Chatnone Gemini 3.1 Flash Lite PreviewlowvsRing-2.6-1Tmedium Gemini 3 Flash PreviewnonevsRing-2.6-1Tmedium Gemma 4 31BnoneDisponible gratisvsRing-2.6-1Tmedium Gemini 3.1 Flash LiteminimalvsRing-2.6-1Tmedium DeepSeek V4 ProhighvsRing-2.6-1Tmedium