Navegación
AI BENCHY
Advertise here

Granite 4.2 8B (high) vs Nemotron 3.5 Lightning (low)

Nemotron 3.5 Lightning (low) lidera en puntuación media con 4.8 vs 4.6. Granite 4.2 8B (high) tiene menor coste de benchmark con $0.084 vs $0.140. Nemotron 3.5 Lightning (low) es más rápido con 59.81s vs 235.89s, con tasas de acierto de 39.4% vs 42.4%.

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-09-02

Rango
#276
Total de tokens de salida
612,215
Tiempo de respuesta (promedio)
235.89s
Costo total
$0.084
Rango
#264
Total de tokens de salida
665,174
Tiempo de respuesta (promedio)
59.81s
Costo total
$0.140
Modelo recomendado Nemotron 3.5 Lightning (low)

Tiene la mejor puntuación aquí (4.8) y responde aproximadamente 3.9x más rápido que Granite 4.2 8B (high).

Comparación detallada

Métrica Granite 4.2 8B Granite 4.2 8B high Lanzamiento: 2026-09-02 Nemotron 3.5 Lightning Nemotron 3.5 Lightning low Lanzamiento: 2026-08-11 Disponible gratis
Puntuación 4.6 4.8
Rango #276 #264
Fiabilidad 7.6 9.8
Consistencia 6.3 6.8
Intentos 66/66 66/66
Pruebas correctas
Tasa de aciertos por intento 39.4% 42.4%
Pruebas inestables 10 9
Ejecuciones totales 66 66
Costo por resultado 2.085 0.000
Costo total $0.084 $0.140
Precio de entrada $0.100 / 1M $0.080 / 1M
Precio de salida $0.150 / 1M $0.200 / 1M
Total de tokens de entrada 43,278 138,792
Tokens de salida 181,083 142,972
Tokens de razonamiento 431,132 522,202
Tiempo de respuesta (promedio) 235.89s 59.81s
Tiempo de respuesta (máximo) 685.87s 312.21s
Tiempo de respuesta (total) 5189.64s 1315.80s
Parámetros 8B 30B en total (3B activos)
Disponibilidad Código abierto Pesos disponibles

Generación showcase de modelos

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#276 IBM: Granite 4.2 8B

high
Provider returned error
Coste
$0.000
Tiempo
0.2s
Tokens
0 tok

#264 Nemotron 3.5 Lightning

low
Coste
$0.000
Tiempo
32.2s
Tokens
6,089 tok

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Programación Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
Granite 4.2 8B 3.8 4.3 33.3% 2 515.34s 7,047 42,438 154,749
Nemotron 3.5 Lightning 4.0 7.8 11.1% 1 224.42s 7,522 72,614 262,558

Comparación rápida

Cambiar par de comparación