Navegación
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

OpenAI: GPT-5.5 vs Qwen: Qwen3.6 Max Preview

Resumen

Comparación benchmark de GPT-5.5 vs Qwen3.6 Max Preview: GPT-5.5 lidera en puntuación media con 8.8 vs 8.5. Qwen3.6 Max Preview tiene menor coste de benchmark con $0.960 vs $3.679. GPT-5.5 es más rápido con 37.98s vs 59.63s, con tasas de acierto de 87.3% vs 81.0%.

Modelo recomendado: Qwen3.6 Max Preview - Su puntuación se mantiene cerca de la mejor aquí (8.5 vs 8.8) y cuesta aproximadamente 3.8x menos que GPT-5.5.

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-06-10

Métrica GPT-5.5 GPT-5.5 medium Lanzamiento: 2026-04-24 Qwen3.6 Max Preview Qwen3.6 Max Preview medium Lanzamiento: 2026-04-20
Puntuación 8.8 8.5
Rango #9 #15
Fiabilidad 10.0 10.0
Consistencia 8.9 9.3
Pruebas correctas
Tasa de aciertos por intento 87.3% 81.0%
Pruebas inestables 3 2
Ejecuciones totales 63 63
Costo por resultado 21.638 7.024
Costo total $3.679 $0.960
Precio de entrada $5.000 / 1M $1.040 / 1M
Precio de salida $30.000 / 1M $6.240 / 1M
Total de tokens de entrada 34,212 42,362
Tokens de salida 1,985 2,273
Tokens de razonamiento 114,925 144,367
Tiempo de respuesta (promedio) 37.98s 59.63s
Tiempo de respuesta (máximo) 332.10s 238.07s
Tiempo de respuesta (total) 797.60s 1252.17s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#9 GPT-5.5

medium
Cost
$0.112
Time
71.9s
Tokens
3,807 tok

#15 Qwen3.6 Max Preview

medium
Cost
$0.024
Time
76.5s
Tokens
3,861 tok

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Trucos anti-IA Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
GPT-5.5 10.0 10.0 100.0% 0 4.66s 606 250 1,335
Qwen3.6 Max Preview 10.0 10.0 100.0% 0 22.13s 672 228 10,075
Programación Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
GPT-5.5 8.8 7.8 88.9% 1 59.77s 7,305 362 24,959
Qwen3.6 Max Preview 8.8 7.8 88.9% 1 146.48s 7,895 427 52,957
Combinado Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
GPT-5.5 10.0 10.0 100.0% 0 19.29s 11,019 312 2,841
Qwen3.6 Max Preview 10.0 10.0 100.0% 0 121.49s 14,934 390 14,575
Análisis y extracción de datos Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
GPT-5.5 10.0 10.0 100.0% 0 4.18s 7,140 234 593
Qwen3.6 Max Preview 10.0 10.0 100.0% 0 41.15s 7,782 270 10,106
Específico del dominio Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
GPT-5.5 5.3 7.2 44.4% 1 164.14s 723 67 79,625
Qwen3.6 Max Preview 2.9 7.2 11.1% 1 95.91s 771 60 30,371
Inteligencia general Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
GPT-5.5 10.0 10.0 100.0% 0 4.16s 477 138 223
Qwen3.6 Max Preview 10.0 10.0 100.0% 0 32.24s 516 129 3,510
Seguimiento de instrucciones Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
GPT-5.5 10.0 10.0 100.0% 0 3.36s 660 93 538
Qwen3.6 Max Preview 10.0 10.0 100.0% 0 24.31s 699 103 5,848
Resolución de acertijos Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
GPT-5.5 10.0 10.0 100.0% 0 6.76s 642 241 2,225
Qwen3.6 Max Preview 10.0 10.0 100.0% 0 24.32s 696 329 7,693
Llamada de herramientas Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
GPT-5.5 10.0 10.0 100.0% 0 10.57s 5,445 258 832
Qwen3.6 Max Preview 10.0 10.0 100.0% 0 18.32s 8,193 309 1,571
Cultura general Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
GPT-5.5 2.8 1.6 33.3% 1 37.86s 195 30 1,754
Qwen3.6 Max Preview 3.0 10.0 0.0% 0 60.56s 204 28 7,661

Comparación rápida

Cambiar par de comparación