AI BENCHY Compare

Google: Gemini 3.1 Pro Preview vs OpenAI: GPT-5.4 Nano

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-05-01

Métrica	Gemini 3.1 Pro Preview Gemini 3.1 Pro Preview medium Lanzamiento: 2026-02-19	GPT-5.4 Nano GPT-5.4 Nano medium Lanzamiento: 2026-03-17

Métrica	Gemini 3.1 Pro Preview Gemini 3.1 Pro Preview medium Lanzamiento: 2026-02-19	GPT-5.4 Nano GPT-5.4 Nano medium Lanzamiento: 2026-03-17
Puntuación	9.6	7.6
Rango	#2	#51
Fiabilidad	N/D	N/D
Consistencia	10.0	9.0
Pruebas correctas
Tasa de aciertos por intento	94.4%	68.5%
Pruebas inestables	0	2
Ejecuciones totales	54	54
Costo por resultado	3.400	0.747
Costo total	$0.578	$0.083
Precio de entrada	$2.000 / 1M	$0.200 / 1M
Precio de salida	$12.000 / 1M	$1.250 / 1M
Tokens de salida	1,932	2,946
Tokens de razonamiento	40,542	58,132
Tiempo de respuesta (promedio)	15.96s	11.21s
Tiempo de respuesta (máximo)	40.61s	94.06s
Tiempo de respuesta (total)	175.52s	201.80s

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Trucos anti-IA	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Gemini 3.1 Pro Preview	10.0	10.0	100.0%	0		7.90s	112	3,218
GPT-5.4 Nano	8.3	10.0	75.0%	0		4.52s	683	2,254

Programación	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Gemini 3.1 Pro Preview	10.0	10.0	100.0%	0		19.88s	405	4,201
GPT-5.4 Nano	10.0	10.0	100.0%	0		13.41s	472	3,616

Combinado	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Gemini 3.1 Pro Preview	9.5	10.0	100.0%	0		40.61s	432	9,281
GPT-5.4 Nano	9.8	10.0	100.0%	0		24.13s	349	5,719

Análisis y extracción de datos	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Gemini 3.1 Pro Preview	10.0	10.0	100.0%	0		7.72s	279	3,904
GPT-5.4 Nano	10.0	10.0	100.0%	0		2.54s	234	516

Específico del dominio	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Gemini 3.1 Pro Preview	7.7	10.0	66.7%	0		32.73s	18	12,424
GPT-5.4 Nano	5.9	7.2	55.6%	1		38.18s	60	43,325

Inteligencia general	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Gemini 3.1 Pro Preview	10.0	10.0	100.0%	0		11.77s	108	1,179
GPT-5.4 Nano	4.5	10.0	0.0%	0		4.15s	179	443

Seguimiento de instrucciones	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Gemini 3.1 Pro Preview	10.0	10.0	100.0%	0		9.56s	72	2,236
GPT-5.4 Nano	9.8	10.0	100.0%	0		1.88s	95	521

Resolución de acertijos	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Gemini 3.1 Pro Preview	10.0	10.0	100.0%	0		7.15s	232	3,117
GPT-5.4 Nano	4.0	7.1	22.2%	1		3.65s	640	1,356

Llamada de herramientas	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de salida	Tokens de razonamiento
Gemini 3.1 Pro Preview	10.0	10.0	100.0%	0		23.15s	274	982
GPT-5.4 Nano	10.0	10.0	100.0%	0		7.71s	234	382

Comparación rápida

Cambiar par de comparación

GPT-5.4 NanomediumvsQwen3.6 Max Previewnone Claude Sonnet 4.6nonevsGPT-5.4 Nanomedium DeepSeek V4 FlashhighvsGPT-5.4 Nanomedium Gemini 3.1 Flash Lite PreviewnonevsGPT-5.4 Nanomedium Claude Opus 4.7nonevsGemini 3.1 Pro Previewmedium Gemini 3.1 Pro PreviewmediumvsGPT-5.5low Gemini 3.1 Flash Lite PreviewlowvsGPT-5.4 Nanomedium Gemini 3 Flash PreviewnonevsGPT-5.4 Nanomedium GPT-5.4 NanomediumvsHY3 PreviewlowDisponible gratis DeepSeek V4 ProhighvsGPT-5.4 Nanomedium Gemma 4 31BnoneDisponible gratisvsGPT-5.4 Nanomedium GPT-5.4 NanomediumvsQwen3.5 Plus 2026-02-15none