Navegación
Advertise here

Step 5 Preview (high) vs MiMo-V2.5 (medium)

MiMo-V2.5 (medium) lidera en puntuación media con 7.1 vs 7.0. MiMo-V2.5 (medium) tiene menor coste de benchmark con $0.130 vs $4.513. MiMo-V2.5 (medium) es más rápido con 49.20s vs 154.41s, con tasas de acierto de 52.2% vs 69.6%.

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-10-09

Modelos comparados

Rango
#169
Total de tokens de salida
1,581,325
Tiempo de respuesta (promedio)
154.41s
Costo total
$4.513
Rango
#163
Total de tokens de salida
332,955
Tiempo de respuesta (promedio)
49.20s
Costo total
$0.130
Modelo recomendado MiMo-V2.5 (medium)

Tiene la mejor puntuación aquí (7.1) y cuesta aproximadamente 34.8x menos que Step 5 Preview (high).

Comparación detallada

Métrica Step 5 Preview Step 5 Preview high Lanzamiento: 2026-10-09 MiMo-V2.5 MiMo-V2.5 medium Lanzamiento: 2026-04-22
Puntuación 7.0 7.1
Rango #169 #163
Fiabilidad 9.5 10.0
Consistencia 8.5 7.6
Intentos 69/69 69/69
Pruebas correctas
Tasa de aciertos por intento 52.2% 69.6%
Pruebas inestables 4 7
Ejecuciones totales 69 69
Costo por resultado 45.130 3.491
Costo total $4.513 $0.130
Precio de entrada $1.000 / 1M $0.140 / 1M
Precio de salida $2.700 / 1M $0.280 / 1M
Precio de lectura de caché $0.050 / 1M $0.003 / 1M
Precio de escritura de caché N/D N/D
Total de tokens de entrada 243,381 259,664
Tokens de salida 1,581,325 8,414
Tokens de razonamiento 0 333,097
Tiempo de respuesta (promedio) 154.41s 49.20s
Tiempo de respuesta (máximo) 455.72s 316.27s
Tiempo de respuesta (total) 3551.40s 1131.69s
Parámetros 600B en total (27B activos) 310B en total (15B activos)
Disponibilidad Código cerrado Código abierto

Los precios de caché se aplican a los tokens de entrada. Las lecturas reutilizan instrucciones guardadas; las escrituras las almacenan y pueden costar más. Los tokens de salida usan el precio de salida.

Generación showcase de modelos

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#169 Step 5 Preview

high
Coste
$0.057
Tiempo
150.1s
Tokens
20,970 tok

#163 MiMo-V2.5

medium
Coste
$0.002
Tiempo
54.8s
Tokens
5,247 tok

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Programación Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
Step 5 Preview 2.9 10.0 0.0% 0 421.68s 7,383 576,000 0
MiMo-V2.5 6.2 4.7 66.7% 2 97.14s 7,422 557 81,977

Cambiar par de comparación