Navegación
AI BENCHY
Advertise here

AI BENCHY Compare

inclusionAI: Ling-2.6-flash vs MiniMax: MiniMax M2.5

Resumen

Comparación benchmark de Ling-2.6-flash vs MiniMax M2.5: MiniMax M2.5 lidera en puntuación media con 5.3 vs 5.0. Ling-2.6-flash tiene menor coste de benchmark con $0.001 vs $0.385. Ling-2.6-flash es más rápido con 9.34s vs 65.37s, con tasas de acierto de 31.8% vs 46.0%.

Modelo recomendado: Ling-2.6-flash - Su puntuación se mantiene cerca de la mejor aquí (5.0 vs 5.3) y cuesta aproximadamente 779.4x menos que MiniMax M2.5.

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-06-04

Métrica Ling-2.6-flash Ling-2.6-flash none Lanzamiento: 2026-04-21 MiniMax M2.5 MiniMax M2.5 medium Lanzamiento: 2026-02-12
Puntuación 5.0 5.3
Rango #138 #129
Fiabilidad 10.0 10.0
Consistencia 9.2 6.5
Pruebas correctas
Tasa de aciertos por intento 31.8% 46.0%
Pruebas inestables 2 9
Ejecuciones totales 63 63
Costo por resultado 0.005 7.900
Costo total $0.001 $0.385
Precio de entrada $0.010 / 1M $0.150 / 1M
Precio de salida $0.030 / 1M $1.150 / 1M
Total de tokens de entrada 40,718 43,706
Tokens de salida 2,878 109,495
Tokens de razonamiento 0 330,814
Tiempo de respuesta (promedio) 9.34s 65.37s
Tiempo de respuesta (máximo) 35.34s 251.36s
Tiempo de respuesta (total) 177.48s 849.76s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#138 Ling-2.6-flash

none
No showcase result has been generated for this model yet.
Cost
$0.000
Time
-
Tokens
0 tok

#129 MiniMax M2.5

medium
Invalid SVG
Cost
$0.000
Time
300.0s
Tokens
0 tok

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Trucos anti-IA Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
Ling-2.6-flash 6.8 8.1 58.3% 1 11.81s 726 573 0
MiniMax M2.5 7.9 6.3 83.3% 2 20.82s 612 286 45,344
Programación Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
Ling-2.6-flash 5.3 10.0 33.3% 0 11.21s 813 381 0
MiniMax M2.5 3.4 9.1 0.0% 0 188.58s 6,076 357 106,177
Combinado Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
Ling-2.6-flash 3.0 10.0 0.0% 0 35.34s 20,818 1,069 0
MiniMax M2.5 4.5 2.1 66.7% 1 60.39s 21,104 740 9,713
Análisis y extracción de datos Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
Ling-2.6-flash 6.5 10.0 50.0% 0 8.48s 8,004 246 0
MiniMax M2.5 4.6 1.7 66.7% 2 7.48s 6,584 266 3,835
Específico del dominio Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
Ling-2.6-flash 3.0 10.0 0.0% 0 4.95s 810 24 0
MiniMax M2.5 2.9 4.4 22.2% 2 237.27s 308 105,047 133,487
Inteligencia general Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
Ling-2.6-flash 4.0 10.0 0.0% 0 1.45s 540 109 0
MiniMax M2.5 3.8 2.5 33.3% 1 6.63s 492 25 1,686
Seguimiento de instrucciones Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
Ling-2.6-flash 9.8 10.0 100.0% 0 5.52s 732 81 0
MiniMax M2.5 7.5 10.0 50.0% 0 621ms 699 156 1,495
Resolución de acertijos Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
Ling-2.6-flash 2.9 7.2 11.1% 1 6.51s 729 151 0
MiniMax M2.5 5.3 7.2 44.4% 1 11.21s 495 1,069 9,605
Llamada de herramientas Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
Ling-2.6-flash 3.0 10.0 0.0% 0 18.80s 7,324 229 0
MiniMax M2.5 10.0 10.0 100.0% 0 15.35s 7,123 269 937
Cultura general Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
Ling-2.6-flash 3.0 10.0 0.0% 0 1.06s 222 15 0
MiniMax M2.5 3.0 10.0 0.0% 0 80.79s 213 1,280 18,535

Comparación rápida

Cambiar par de comparación