Navegación
Advertise here

Trinity Large Thinking (medium) vs Inkling (low)

La puntuación media está prácticamente empatada en 6.1 vs 6.1. Inkling (low) tiene menor coste de benchmark con $0.187 vs $0.756. Inkling (low) es más rápido con 5.11s vs 85.44s, con tasas de acierto de 48.5% vs 54.6%.

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-09-18

Modelos comparados

Rango
#204
Total de tokens de salida
1,016,785
Tiempo de respuesta (promedio)
85.44s
Costo total
$0.756
Rango
#203
Total de tokens de salida
18,904
Tiempo de respuesta (promedio)
5.11s
Costo total
$0.187
Modelo recomendado Inkling (low)

Tiene la mejor puntuación aquí (6.1) y cuesta aproximadamente 4.1x menos que Trinity Large Thinking (medium).

Comparación detallada

Métrica Trinity Large Thinking Trinity Large Thinking medium Lanzamiento: 2026-07-28 Inkling Inkling low Lanzamiento: 2026-07-18
Puntuación 6.1 6.1
Rango #204 #203
Fiabilidad 10.0 10.0
Consistencia 7.9 8.6
Intentos 66/66 66/66
Pruebas correctas
Tasa de aciertos por intento 48.5% 54.6%
Pruebas inestables 6 4
Ejecuciones totales 66 66
Costo por resultado 9.972 1.865
Costo total $0.756 $0.187
Precio de entrada $0.250 / 1M $1.000 / 1M
Precio de salida $0.800 / 1M $4.050 / 1M
Total de tokens de entrada 118,486 109,893
Tokens de salida 156,166 8,580
Tokens de razonamiento 860,619 10,324
Tiempo de respuesta (promedio) 85.44s 5.11s
Tiempo de respuesta (máximo) 525.14s 41.58s
Tiempo de respuesta (total) 1879.75s 112.46s
Parámetros 398B en total (13B activos) 975B en total (41B activos)
Disponibilidad Pesos disponibles Código abierto

Generación showcase de modelos

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#204 Trinity Large Thinking

medium
Coste
$0.016
Tiempo
75.9s
Tokens
19,401 tok

#203 Thinking Machines: Inkling

low
Coste
$0.002
Tiempo
6.1s
Tokens
502 tok

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Programación Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
Trinity Large Thinking 7.5 10.0 66.7% 0 179.02s 7,248 7,413 351,155
Inkling 5.1 7.2 22.2% 1 8.71s 7,374 355 4,961

Comparación rápida

Cambiar par de comparación