Navegación
Advertise here

LongCat 2.0 (medium) vs Qwen3.5-27B

Qwen3.5-27B lidera en puntuación media con 7.2 vs 7.2. Qwen3.5-27B tiene menor coste de benchmark con $0.116 vs $0.593. Qwen3.5-27B es más rápido con 9.98s vs 144.88s, con tasas de acierto de 59.4% vs 47.8%.

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-10-01

Modelos comparados

Rango
#145
Total de tokens de salida
422,234
Tiempo de respuesta (promedio)
144.88s
Costo total
$0.593
Rango
#139
Total de tokens de salida
36,422
Tiempo de respuesta (promedio)
9.98s
Costo total
$0.116
Modelo recomendado Qwen3.5-27B

Tiene la mejor puntuación aquí (7.2) y cuesta aproximadamente 5.1x menos que LongCat 2.0 (medium).

Comparación detallada

Métrica LongCat 2.0 LongCat 2.0 medium Lanzamiento: 2026-07-20 Qwen3.5-27B Qwen3.5-27B none Lanzamiento: 2026-02-24
Puntuación 7.2 7.2
Rango #145 #139
Fiabilidad 10.0 10.0
Consistencia 9.0 9.4
Intentos 69/69 69/69
Pruebas correctas
Tasa de aciertos por intento 59.4% 47.8%
Pruebas inestables 3 2
Ejecuciones totales 69 69
Costo por resultado 4.942 1.153
Costo total $0.593 $0.116
Precio de entrada $0.300 / 1M $0.195 / 1M
Precio de salida $1.200 / 1M $1.560 / 1M
Total de tokens de entrada 287,669 283,977
Tokens de salida 47,204 36,422
Tokens de razonamiento 375,030 0
Tiempo de respuesta (promedio) 144.88s 9.98s
Tiempo de respuesta (máximo) 939.52s 124.53s
Tiempo de respuesta (total) 3332.19s 229.52s
Parámetros 1.6T en total (48B activos) 27B
Disponibilidad Código abierto Código abierto

Generación showcase de modelos

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#145 LongCat 2.0

medium
Coste
$0.016
Tiempo
285.1s
Tokens
13,057 tok

#139 Qwen3.5-27B

none
Coste
$0.007
Tiempo
42.9s
Tokens
4,273 tok

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Programación Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
LongCat 2.0 10.0 10.0 100.0% 0 455.00s 7,419 533 214,143
Qwen3.5-27B 5.8 10.0 33.3% 0 1.80s 7,913 415 0

Comparación rápida

Cambiar par de comparación