- Rango
- #253
- Total de tokens de salida
- 943,044
- Tiempo de respuesta (promedio)
- 74.52s
- Costo total
- $0.645
Trinity Large Thinking (high) vs Space Bunny Alpha (low)
Trinity Large Thinking (high) lidera en puntuación media con 5.7 vs 5.7. Space Bunny Alpha (low) tiene menor coste de benchmark con $0.000 vs $0.645. Space Bunny Alpha (low) es más rápido con 30.63s vs 74.52s, con tasas de acierto de 42.0% vs 53.6%.
Modelos comparados
- Rango
- #259
- Total de tokens de salida
- 194,450
- Tiempo de respuesta (promedio)
- 30.63s
- Costo total
- $0.000
Modelo recomendado
Trinity Large Thinking (high)
Tiene la puntuación más alta en esta comparación (5.7) y el mejor equilibrio general entre coste y tiempo de respuesta en los 2 modelos.
Comparación detallada
| Métrica | Trinity Large Thinking Trinity Large Thinking high | Space Bunny Alpha Space Bunny Alpha low |
|---|---|---|
| Puntuación | 5.7 | 5.7 |
| Rango | #253 | #259 |
| Fiabilidad | 10.0 | 10.0 |
| Consistencia | 7.3 | 6.5 |
| Intentos | 69/69 | 69/69 |
| Pruebas correctas | ||
| Tasa de aciertos por intento | 42.0% | 53.6% |
| Pruebas inestables | 8 | 10 |
| Ejecuciones totales | 69 | 69 |
| Costo por resultado | 11.289 | 0.000 |
| Costo total | $0.645 | $0.000 |
| Precio de entrada | $0.250 / 1M | $0.000 / 1M |
| Precio de salida | $0.800 / 1M | $0.000 / 1M |
| Total de tokens de entrada | 283,116 | 289,086 |
| Tokens de salida | 277,920 | 194,450 |
| Tokens de razonamiento | 665,124 | 0 |
| Tiempo de respuesta (promedio) | 74.52s | 30.63s |
| Tiempo de respuesta (máximo) | 510.21s | 340.88s |
| Tiempo de respuesta (total) | 1713.90s | 704.47s |
| Parámetros | 398B en total (13B activos) | - |
| Disponibilidad | Pesos disponibles | Código cerrado |
Generación showcase de modelos
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#253 Trinity Large Thinking
high- Coste
- $0.028
- Tiempo
- 130.1s
- Tokens
- 34,387 tok
#259 Space Bunny Alpha
low- Coste
- $0.000
- Tiempo
- 20.6s
- Tokens
- 3,462 tok
Mejores modelos por puntuación
Puntuación vs costo total
Tiempo de respuesta (promedio)
Puntuación vs Tiempo de respuesta (promedio)
Total de tokens de salida
Puntuación vs Total de tokens de salida
Desglose por categoría
| Tareas de agentes | Puntuación | Consistencia | Tasa de aciertos por intento | Pruebas inestables | Pruebas correctas | Tiempo de respuesta (promedio) | Tokens de entrada | Tokens de salida | Tokens de razonamiento |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 10.0 | 10.0 | 100.0% | 0 | 44.97s | 181,340 | 1,553 | 8,872 | |
| Space Bunny Alpha | 4.7 | 3.1 | 33.3% | 1 | 89.00s | 169,129 | 10,896 | 0 |
| Trucos anti-IA | Puntuación | Consistencia | Tasa de aciertos por intento | Pruebas inestables | Pruebas correctas | Tiempo de respuesta (promedio) | Tokens de entrada | Tokens de salida | Tokens de razonamiento |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 6.7 | 8.1 | 58.3% | 1 | 4.13s | 663 | 3,108 | 7,565 | |
| Space Bunny Alpha | 6.9 | 5.8 | 75.0% | 2 | 2.75s | 2,130 | 2,255 | 0 |
| Programación | Puntuación | Consistencia | Tasa de aciertos por intento | Pruebas inestables | Pruebas correctas | Tiempo de respuesta (promedio) | Tokens de entrada | Tokens de salida | Tokens de razonamiento |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 3.7 | 4.7 | 33.3% | 2 | 245.04s | 7,204 | 83,616 | 266,836 | |
| Space Bunny Alpha | 5.6 | 4.7 | 55.6% | 2 | 6.60s | 8,493 | 5,897 | 0 |
| Combinado | Puntuación | Consistencia | Tasa de aciertos por intento | Pruebas inestables | Pruebas correctas | Tiempo de respuesta (promedio) | Tokens de entrada | Tokens de salida | Tokens de razonamiento |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 3.0 | 10.0 | 0.0% | 0 | 262.39s | 76,626 | 14,706 | 149,243 | |
| Space Bunny Alpha | 3.8 | 5.8 | 33.3% | 1 | 12.17s | 85,984 | 8,071 | 0 |
| Análisis y extracción de datos | Puntuación | Consistencia | Tasa de aciertos por intento | Pruebas inestables | Pruebas correctas | Tiempo de respuesta (promedio) | Tokens de entrada | Tokens de salida | Tokens de razonamiento |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 6.3 | 5.8 | 66.7% | 1 | 13.98s | 6,906 | 580 | 9,338 | |
| Space Bunny Alpha | 10.0 | 10.0 | 100.0% | 0 | 1.35s | 7,890 | 401 | 0 |
| Específico del dominio | Puntuación | Consistencia | Tasa de aciertos por intento | Pruebas inestables | Pruebas correctas | Tiempo de respuesta (promedio) | Tokens de entrada | Tokens de salida | Tokens de razonamiento |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 2.9 | 7.2 | 11.1% | 1 | 66.94s | 756 | 163,364 | 166,091 | |
| Space Bunny Alpha | 5.3 | 7.2 | 44.4% | 1 | 65.69s | 1,869 | 61,188 | 0 |
| Inteligencia general | Puntuación | Consistencia | Tasa de aciertos por intento | Pruebas inestables | Pruebas correctas | Tiempo de respuesta (promedio) | Tokens de entrada | Tokens de salida | Tokens de razonamiento |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 6.5 | 3.4 | 66.7% | 1 | 12.90s | 501 | 5,700 | 5,942 | |
| Space Bunny Alpha | 4.4 | 9.9 | 0.0% | 0 | 2.78s | 855 | 427 | 0 |
| Seguimiento de instrucciones | Puntuación | Consistencia | Tasa de aciertos por intento | Pruebas inestables | Pruebas correctas | Tiempo de respuesta (promedio) | Tokens de entrada | Tokens de salida | Tokens de razonamiento |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 6.3 | 10.0 | 50.0% | 0 | 4.12s | 684 | 88 | 2,853 | |
| Space Bunny Alpha | 4.4 | 2.7 | 33.3% | 2 | 1.43s | 1,425 | 351 | 0 |
| Resolución de acertijos | Puntuación | Consistencia | Tasa de aciertos por intento | Pruebas inestables | Pruebas correctas | Tiempo de respuesta (promedio) | Tokens de entrada | Tokens de salida | Tokens de razonamiento |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 4.7 | 5.2 | 33.3% | 2 | 3.84s | 678 | 2,566 | 3,368 | |
| Space Bunny Alpha | 7.9 | 9.9 | 66.7% | 0 | 3.51s | 1,782 | 1,939 | 0 |
| Llamada de herramientas | Puntuación | Consistencia | Tasa de aciertos por intento | Pruebas inestables | Pruebas correctas | Tiempo de respuesta (promedio) | Tokens de entrada | Tokens de salida | Tokens de razonamiento |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 10.0 | 10.0 | 100.0% | 0 | 5.96s | 7,551 | 282 | 1,440 | |
| Space Bunny Alpha | 4.7 | 1.6 | 66.7% | 1 | 3.48s | 8,953 | 370 | 0 |
| Cultura general | Puntuación | Consistencia | Tasa de aciertos por intento | Pruebas inestables | Pruebas correctas | Tiempo de respuesta (promedio) | Tokens de entrada | Tokens de salida | Tokens de razonamiento |
|---|---|---|---|---|---|---|---|---|---|
| Trinity Large Thinking | 3.0 | 10.0 | 0.0% | 0 | 125.13s | 207 | 2,357 | 43,576 | |
| Space Bunny Alpha | 3.0 | 10.0 | 0.0% | 0 | 340.88s | 576 | 102,655 | 0 |
Comparación rápida
Cambiar par de comparación
Trinity Large ThinkinghighvsRing 2.6 1tmediumTrinity Large ThinkinghighvsGPT-5 NanomediumGPT-5.4nonevsSpace Bunny AlphalowTrinity Large ThinkinghighvsGPT-5.4 MininoneGemma 4 31BnoneDisponible gratisvsSpace Bunny AlphalowTrinity Large ThinkinghighvsSeed 2.1 TurbononeTrinity Large ThinkinghighvsDots 3 Note PreviewmediumDisponible gratisSpace Bunny AlphalowvsSolar Pro 4noneDots 3 Note PreviewmediumDisponible gratisvsSpace Bunny AlphalowTrinity Large ThinkinghighvsDeepSeek V4.1 FlashnoneSeed 2.1 TurbononevsSpace Bunny AlphalowTrinity Large ThinkinghighvsGPT-5.6 Terranone