Navegación
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

OpenAI: GPT-5.3-Codex vs Qwen: Qwen3.6 Max Preview

Resumen

Comparación benchmark de GPT-5.3-Codex vs Qwen3.6 Max Preview: GPT-5.3-Codex lidera en puntuación media con 8.9 vs 8.9. GPT-5.3-Codex tiene menor coste de benchmark con $0.740 vs $0.960. GPT-5.3-Codex es más rápido con 16.22s vs 59.63s, con tasas de acierto de 82.5% vs 81.0%.

Modelo recomendado: GPT-5.3-Codex - Tiene la mejor puntuación aquí (8.9) y responde aproximadamente 3.7x más rápido que Qwen3.6 Max Preview.

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-06-18

Métrica GPT-5.3-Codex GPT-5.3-Codex medium Lanzamiento: 2026-02-05 Qwen3.6 Max Preview Qwen3.6 Max Preview medium Lanzamiento: 2026-04-20
Puntuación 8.9 8.9
Rango #10 #11
Fiabilidad 10.0 10.0
Consistencia 8.5 9.3
Pruebas correctas
Tasa de aciertos por intento 82.5% 81.0%
Pruebas inestables 4 2
Ejecuciones totales 63 63
Costo por resultado 4.932 7.024
Costo total $0.740 $0.960
Precio de entrada $1.750 / 1M $1.040 / 1M
Precio de salida $14.000 / 1M $6.240 / 1M
Total de tokens de entrada 34,299 42,362
Tokens de salida 2,357 2,273
Tokens de razonamiento 46,189 144,367
Tiempo de respuesta (promedio) 16.22s 59.63s
Tiempo de respuesta (máximo) 100.93s 238.07s
Tiempo de respuesta (total) 340.67s 1252.17s

Generación showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#10 GPT-5.3-Codex

medium
Coste
$0.049
Tiempo
54.9s
Tokens
3,580 tok

#11 Qwen3.6 Max Preview

medium
Coste
$0.024
Tiempo
76.5s
Tokens
3,861 tok

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Trucos anti-IA Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
GPT-5.3-Codex 8.7 7.9 91.7% 1 4.16s 606 240 1,722
Qwen3.6 Max Preview 10.0 10.0 100.0% 0 22.13s 672 228 10,075
Programación Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
GPT-5.3-Codex 10.0 10.0 100.0% 0 19.50s 7,302 535 10,890
Qwen3.6 Max Preview 8.8 7.8 88.9% 1 146.48s 7,895 427 52,957
Combinado Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
GPT-5.3-Codex 10.0 10.0 100.0% 0 19.56s 11,019 364 2,731
Qwen3.6 Max Preview 10.0 10.0 100.0% 0 121.49s 14,934 390 14,575
Análisis y extracción de datos Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
GPT-5.3-Codex 10.0 10.0 100.0% 0 3.07s 7,140 234 728
Qwen3.6 Max Preview 10.0 10.0 100.0% 0 41.15s 7,782 270 10,106
Específico del dominio Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
GPT-5.3-Codex 5.9 7.2 55.6% 1 64.31s 813 64 25,308
Qwen3.6 Max Preview 2.9 7.2 11.1% 1 95.91s 771 60 30,371
Inteligencia general Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
GPT-5.3-Codex 4.6 10.0 0.0% 0 4.87s 477 187 331
Qwen3.6 Max Preview 10.0 10.0 100.0% 0 32.24s 516 129 3,510
Seguimiento de instrucciones Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
GPT-5.3-Codex 10.0 10.0 100.0% 0 3.04s 660 93 693
Qwen3.6 Max Preview 10.0 10.0 100.0% 0 24.31s 699 103 5,848
Resolución de acertijos Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
GPT-5.3-Codex 9.0 7.9 88.9% 1 5.05s 642 356 1,593
Qwen3.6 Max Preview 10.0 10.0 100.0% 0 24.32s 696 329 7,693
Llamada de herramientas Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
GPT-5.3-Codex 10.0 10.0 100.0% 0 6.37s 5,445 254 492
Qwen3.6 Max Preview 10.0 10.0 100.0% 0 18.32s 8,193 309 1,571
Cultura general Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
GPT-5.3-Codex 2.8 1.6 33.3% 1 14.43s 195 30 1,701
Qwen3.6 Max Preview 3.0 10.0 0.0% 0 60.56s 204 28 7,661

Comparación rápida

Cambiar par de comparación