AI BENCHY Compare

Google: Gemma 4 26B A4B vs OpenAI: GPT-5.5

Resumen

Comparación benchmark de Gemma 4 26B A4B vs GPT-5.5: GPT-5.5 lidera en puntuación media con 9.3 vs 5.5. Gemma 4 26B A4B tiene menor coste de benchmark con $0.004 vs $0.907. Gemma 4 26B A4B es más rápido con 5.91s vs 9.76s, con tasas de acierto de 44.4% vs 85.7%.

Modelo recomendado: GPT-5.5 - Tiene la puntuación más alta en esta comparación (9.3) y el mejor equilibrio general entre coste y tiempo de respuesta en los 2 modelos.

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-07-02

Métrica	Gemma 4 26B A4B Gemma 4 26B A4B none Lanzamiento: 2026-04-03 Disponible gratis	GPT-5.5 GPT-5.5 low Lanzamiento: 2026-04-24

Métrica	Gemma 4 26B A4B Gemma 4 26B A4B none Lanzamiento: 2026-04-03 Disponible gratis	GPT-5.5 GPT-5.5 low Lanzamiento: 2026-04-24
Puntuación	5.5	9.3
Rango	#125	#4
Fiabilidad	10.0	10.0
Consistencia	9.2	10.0
Pruebas correctas
Tasa de aciertos por intento	44.4%	85.7%
Pruebas inestables	2	0
Ejecuciones totales	63	63
Costo por resultado	0.068	5.035
Costo total	$0.004	$0.907
Precio de entrada	$0.060 / 1M	$5.000 / 1M
Precio de salida	$0.330 / 1M	$30.000 / 1M
Total de tokens de entrada	40,038	34,209
Tokens de salida	1,824	2,046
Tokens de razonamiento	0	22,460
Tiempo de respuesta (promedio)	5.91s	9.76s
Tiempo de respuesta (máximo)	57.10s	56.19s
Tiempo de respuesta (total)	124.05s	204.92s

Generación showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#125 Gemma 4 26B A4B

none

Coste: $0.001
Tiempo: 39.5s
Tokens: 790 tok

#4 GPT-5.5

low

Coste: $0.068
Tiempo: 37.0s
Tokens: 2,339 tok

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Trucos anti-IA	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Gemma 4 26B A4B	8.3	10.0	75.0%	0		1.28s	852	230	0
GPT-5.5	10.0	10.0	100.0%	0		4.41s	606	238	1,020

Programación	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Gemma 4 26B A4B	3.7	7.2	22.2%	1		4.16s	7,736	476	0
GPT-5.5	10.0	10.0	100.0%	0		15.04s	7,302	423	6,402

Combinado	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Gemma 4 26B A4B	3.0	10.0	0.0%	0		30.53s	13,650	309	0
GPT-5.5	10.0	10.0	100.0%	0		9.56s	11,019	303	717

Análisis y extracción de datos	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Gemma 4 26B A4B	10.0	10.0	100.0%	0		1.70s	8,352	285	0
GPT-5.5	10.0	10.0	100.0%	0		3.28s	7,140	228	157

Específico del dominio	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Gemma 4 26B A4B	3.6	7.2	22.2%	1		2.49s	903	27	0
GPT-5.5	5.3	10.0	33.3%	0		28.05s	723	69	11,609

Inteligencia general	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Gemma 4 26B A4B	4.0	10.0	0.0%	0		3.54s	576	85	0
GPT-5.5	10.0	10.0	100.0%	0		5.17s	477	133	245

Seguimiento de instrucciones	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Gemma 4 26B A4B	6.3	10.0	50.0%	0		690ms	795	75	0
GPT-5.5	9.9	10.0	100.0%	0		3.74s	660	93	415

Resolución de acertijos	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Gemma 4 26B A4B	6.2	10.0	33.3%	0		744ms	828	114	0
GPT-5.5	10.0	10.0	100.0%	0		4.74s	642	279	954

Llamada de herramientas	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Gemma 4 26B A4B	10.0	10.0	100.0%	0		57.10s	6,123	210	0
GPT-5.5	10.0	10.0	100.0%	0		4.96s	5,445	250	101

Cultura general	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Gemma 4 26B A4B	3.0	10.0	0.0%	0		778ms	223	13	0
GPT-5.5	3.0	10.0	0.0%	0		10.06s	195	30	840

Comparación rápida

Cambiar par de comparación

GPT-5.5lowvsQwen3.7 Maxmedium Claude Fable 5mediumvsGPT-5.5low Gemini 3.1 Pro PreviewmediumvsGPT-5.5low Gemini 3.5 FlashmediumvsGPT-5.5low Gemini 3 Flash PreviewmediumvsGPT-5.5low Gemma 4 26B A4BnoneDisponible gratisvsMiniMax M2.7medium North Mini CodemediumDisponible gratisvsGemma 4 26B A4BnoneDisponible gratis Gemma 4 26B A4BnoneDisponible gratisvsMistral Small 4medium GPT-5.5lowvsQwen3.6 Max Previewmedium Claude Opus 4.8mediumvsGPT-5.5low Gemini 3.5 FlashhighvsGPT-5.5low CobuddymediumvsGemma 4 26B A4BnoneDisponible gratis