Navegación
Advertise here

Ember-1 (low) vs MiniMax M3 (medium)

La puntuación media está prácticamente empatada en 7.5 vs 7.5. MiniMax M3 (medium) tiene menor coste de benchmark con $0.300 vs $0.662. Ember-1 (low) es más rápido con 30.98s vs 75.15s, con tasas de acierto de 66.7% vs 62.1%.

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-09-28

Modelos comparados

Rango
#120
Total de tokens de salida
37,467
Tiempo de respuesta (promedio)
30.98s
Costo total
$0.662
Rango
#121
Total de tokens de salida
275,782
Tiempo de respuesta (promedio)
75.15s
Costo total
$0.300
Modelo recomendado MiniMax M3 (medium)

Tiene la mejor puntuación aquí (7.5) y cuesta aproximadamente 2.2x menos que Ember-1 (low).

Comparación detallada

Métrica Ember-1 Ember-1 low Lanzamiento: 2026-09-28 MiniMax M3 MiniMax M3 medium Lanzamiento: 2026-06-01
Puntuación 7.5 7.5
Rango #120 #121
Fiabilidad 8.1 9.7
Consistencia 8.5 8.0
Intentos 66/66 66/66
Pruebas correctas
Tasa de aciertos por intento 66.7% 62.1%
Pruebas inestables 4 5
Ejecuciones totales 66 66
Costo por resultado 5.085 2.724
Costo total $0.662 $0.300
Precio de entrada $3.000 / 1M $0.300 / 1M
Precio de salida $15.000 / 1M $1.200 / 1M
Total de tokens de entrada 33,011 121,996
Tokens de salida 4,780 90,051
Tokens de razonamiento 32,687 185,731
Tiempo de respuesta (promedio) 30.98s 75.15s
Tiempo de respuesta (máximo) 93.10s 431.03s
Tiempo de respuesta (total) 681.50s 1578.24s
Parámetros ~2.8T en total (~104B activos) 428B en total (23B activos)
Disponibilidad Código cerrado Pesos disponibles

Generación showcase de modelos

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#120 Ember-1

low
Coste
$0.016
Tiempo
24.2s
Tokens
1,165 tok

#121 MiniMax M3

medium
Coste
$0.012
Tiempo
154.4s
Tokens
10,018 tok

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Programación Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
Ember-1 10.0 10.0 100.0% 0 37.91s 8,097 2,518 13,142
MiniMax M3 6.1 6.5 55.6% 1 144.74s 5,804 6,223 32,667

Comparación rápida

Cambiar par de comparación