Navegación
Advertise here

Ling 3.0 Tiny (high) vs GPT-6 Luna Decisions (default)

Ling 3.0 Tiny (high) lidera en puntuación media con 3.7 vs 2.4. Ling 3.0 Tiny (high) tiene menor coste de benchmark con $0.000 vs $0.005. GPT-6 Luna Decisions (default) es más rápido con 495ms vs 72.24s, con tasas de acierto de 23.2% vs 13.0%.

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-10-07

Modelos comparados

Rango
#368
Total de tokens de salida
939,018
Tiempo de respuesta (promedio)
72.24s
Costo total
$0.000
Rango
#390
Total de tokens de salida
0
Tiempo de respuesta (promedio)
495ms
Costo total
$0.005
Modelo recomendado Ling 3.0 Tiny (high)

Tiene la puntuación más alta en esta comparación (3.7) y el mejor equilibrio general entre coste y tiempo de respuesta en los 2 modelos.

Comparación detallada

Métrica Ling 3.0 Tiny Ling 3.0 Tiny high Lanzamiento: 2026-08-07 GPT-6 Luna Decisions GPT-6 Luna Decisions default Lanzamiento: 2026-10-07
Puntuación 3.7 2.4
Rango #368 #390
Fiabilidad 10.0 10.0
Consistencia 8.9 5.2
Intentos 69/69 36/69
Pruebas correctas
Tasa de aciertos por intento 23.2% 13.0%
Pruebas inestables 3 0
Ejecuciones totales 69 36
Costo por resultado 0.000 0.159
Costo total $0.000 $0.005
Precio de entrada $0.000 / 1M $0.100 / 1M
Precio de salida $0.000 / 1M $0.000 / 1M
Precio de lectura de caché N/D $0.000 / 1M
Precio de escritura de caché N/D $0.000 / 1M
Total de tokens de entrada 115,314 47,583
Tokens de salida 133,965 0
Tokens de razonamiento 816,718 0
Tiempo de respuesta (promedio) 72.24s 495ms
Tiempo de respuesta (máximo) 345.15s 842ms
Tiempo de respuesta (total) 1589.23s 5.94s
Parámetros 7.9B en total (1.3B activos) ~400B en total (~17B activos)
Disponibilidad Código abierto Código cerrado

Los precios de caché se aplican a los tokens de entrada. Las lecturas reutilizan instrucciones guardadas; las escrituras las almacenan y pueden costar más. Los tokens de salida usan el precio de salida.

Generación showcase de modelos

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#368 Ling 3.0 Tiny

high
No output was saved. The original provider response or failure reason is unavailable.
Coste
$0.000
Tiempo
169.5s
Tokens
5,252 tok

#390 GPT-6 Luna Decisions

default
Aún no se ha generado ningún resultado showcase para este modelo.
Coste
N/D
Tiempo
-
Tokens
0 tok

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Programación Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
Ling 3.0 Tiny 2.9 10.0 0.0% 0 177.65s 7,767 59,320 177,922
GPT-6 Luna Decisions 2.5 6.7 0.0% 0 447ms 22,197 0 0

Comparación rápida

Cambiar par de comparación