Navegación
Advertise here

Mistral Large 4 vs Hy4 preview (low)

Mistral Large 4 lidera en puntuación media con 5.5 vs 5.4. Mistral Large 4 tiene menor coste de benchmark con $0.353 vs $1.855. Mistral Large 4 es más rápido con 28.46s vs 207.21s, con tasas de acierto de 30.4% vs 21.7%.

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-10-06

Modelos comparados

Rango
#274
Total de tokens de salida
84,218
Tiempo de respuesta (promedio)
28.46s
Costo total
$0.353
Rango
#286
Total de tokens de salida
687,477
Tiempo de respuesta (promedio)
207.21s
Costo total
$1.855
Modelo recomendado Mistral Large 4

Tiene la mejor puntuación aquí (5.5) y cuesta aproximadamente 5.3x menos que Hy4 preview (low).

Comparación detallada

Métrica Mistral Large 4 Mistral Large 4 none Lanzamiento: 2026-10-06 Hy4 preview Hy4 preview low Lanzamiento: 2026-08-29
Puntuación 5.5 5.4
Rango #274 #286
Fiabilidad 9.9 6.5
Consistencia 8.8 8.2
Intentos 69/69 69/69
Pruebas correctas
Tasa de aciertos por intento 30.4% 21.7%
Pruebas inestables 4 4
Ejecuciones totales 69 69
Costo por resultado 7.044 61.455
Costo total $0.353 $1.855
Precio de entrada $0.680 / 1M $0.834 / 1M
Precio de salida $2.090 / 1M $2.501 / 1M
Precio de lectura de caché $0.070 / 1M $0.042 / 1M
Precio de escritura de caché N/D N/D
Total de tokens de entrada 259,048 162,180
Tokens de salida 84,218 5,030
Tokens de razonamiento 0 682,447
Tiempo de respuesta (promedio) 28.46s 207.21s
Tiempo de respuesta (máximo) 385.10s 597.45s
Tiempo de respuesta (total) 654.47s 4765.91s
Parámetros 1.05T en total (49B activos) 770B en total (49B activos)
Disponibilidad Código cerrado Código abierto

Los precios de caché se aplican a los tokens de entrada. Las lecturas reutilizan instrucciones guardadas; las escrituras las almacenan y pueden costar más. Los tokens de salida usan el precio de salida.

Generación showcase de modelos

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#274 Mistral Large 4

none
Coste
$0.004
Tiempo
26.7s
Tokens
1,923 tok

#286 Hy4 preview

low
Provider returned error
Coste
$0.000
Tiempo
1.1s
Tokens
0 tok

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Programación Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
Mistral Large 4 5.4 7.8 22.2% 1 153.02s 7,431 62,517 0
Hy4 preview 5.2 8.6 0.0% 0 219.15s 6,110 135 96,407

Comparación rápida

Cambiar par de comparación