Navegación
AI BENCHY
Your ad here

AI BENCHY Compare

Trinity Large Preview vs Mistral: Mistral Small 4

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-03-17

Métrica Trinity Large Preview Trinity Large Preview none Lanzamiento: 2026-01-27 Disponible gratis Mistral Small 4 Mistral Small 4 medium Lanzamiento: 2026-03-16
Rango #60 #55
Puntuación 5.3 5.6
Consistencia 9.6 7.0
Costo por resultado 0.000 0.502
Costo total $0.000 $0.026
Pruebas correctas
Tasa de aciertos por intento 31.4% 49.0%
Pruebas inestables 1 6
Ejecuciones totales 51 51
Tokens de salida 1,843 12,288
Tokens de razonamiento 0 28,112
Tiempo de respuesta (promedio) 3.04s 4.18s
Tiempo de respuesta (máximo) 8.91s 25.25s
Tiempo de respuesta (total) 51.75s 71.03s

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Trucos anti-IA Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Trinity Large Preview 3.0 10.0 0.0% 0 3.02s 593 0
Mistral Small 4 5.6 3.8 66.7% 3 2.67s 4,055 4,778
Combinado Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Trinity Large Preview 3.0 10.0 0.0% 0 8.91s 294 0
Mistral Small 4 3.0 10.0 0.0% 0 25.25s 2,612 10,700
Análisis y extracción de datos Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Trinity Large Preview 10.0 10.0 100.0% 0 3.26s 186 0
Mistral Small 4 7.3 5.9 83.3% 1 1.23s 335 723
Específico del dominio Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Trinity Large Preview 5.3 10.0 33.3% 0 877ms 25 0
Mistral Small 4 5.3 7.2 44.4% 1 6.11s 2,621 6,904
Inteligencia general Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Trinity Large Preview 4.4 9.9 0.0% 0 2.86s 124 0
Mistral Small 4 4.8 10.0 0.0% 0 2.05s 821 828
Seguimiento de instrucciones Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Trinity Large Preview 4.1 6.7 16.7% 1 1.09s 63 0
Mistral Small 4 7.3 5.8 83.3% 1 1.38s 540 1,031
Puzzle Solving Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Trinity Large Preview 5.4 10.0 33.3% 0 3.30s 291 0
Mistral Small 4 3.4 9.7 0.0% 0 2.00s 983 2,338
Llamada de herramientas Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Trinity Large Preview 10.0 10.0 100.0% 0 6.67s 267 0
Mistral Small 4 10.0 10.0 100.0% 0 3.50s 321 810

Comparación rápida

Cambiar par de comparación