Navegación
AI BENCHY
Comparar Gráficos Metodología
❤️ Made by XCS
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 3 Flash Preview vs OpenAI: GPT-5.4

Comparar:

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-03-06

Métrica Google: Gemini 3 Flash Preview none Lanzamiento: 2025-12-17 OpenAI: GPT-5.4 medium Lanzamiento: 2026-03-05
Rango #20 #9
Puntaje prom. 7.2 8.0
Consistencia 9.0 8.5
Costo por resultado 0.169 6.601
Costo total $0.019 $0.793
Pruebas correctas
Tasa de aciertos por intento 75.0% 83.3%
Pruebas inestables 2 3
Ejecuciones totales 48 (16 x 3) 48 (16 x 3)
Tokens de salida 1,411 1,756
Tokens de razonamiento 0 46,642
Tiempo de respuesta (promedio) 1.75s 20.05s
Tiempo de respuesta (máximo) 3.56s 100.41s
Tiempo de respuesta (total) 15.71s 320.87s

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntaje prom. vs Tiempo de respuesta (promedio)

Desglose por categoría

Trucos anti-IA Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Google: Gemini 3 Flash Preview 7.0 10.0 66.7% 0 1.59s 208 0
OpenAI: GPT-5.4 10.0 10.0 100.0% 0 5.02s 216 1,466
Combinado Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Google: Gemini 3 Flash Preview 10.0 1.6 66.7% 1 3.56s 350 0
OpenAI: GPT-5.4 10.0 10.0 100.0% 0 20.57s 301 3,543
Análisis y extracción de datos Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Google: Gemini 3 Flash Preview 9.9 10.0 100.0% 0 1.41s 279 0
OpenAI: GPT-5.4 9.9 10.0 100.0% 0 5.32s 234 804
Específico del dominio Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Google: Gemini 3 Flash Preview 7.0 10.0 66.7% 0 963ms 18 0
OpenAI: GPT-5.4 4.0 7.2 44.4% 1 74.27s 61 34,748
Inteligencia general Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Google: Gemini 3 Flash Preview 10.0 10.0 100.0% 0 1.13s 104 0
OpenAI: GPT-5.4 5.0 3.1 33.3% 1 4.92s 145 321
Seguimiento de instrucciones Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Google: Gemini 3 Flash Preview 5.5 5.8 66.7% 1 1.58s 74 0
OpenAI: GPT-5.4 10.0 10.0 100.0% 0 3.11s 93 897
Puzzle Solving Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Google: Gemini 3 Flash Preview 7.0 10.0 66.7% 0 1.06s 144 0
OpenAI: GPT-5.4 7.0 7.2 88.9% 1 9.13s 442 3,832
Llamada de herramientas Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Google: Gemini 3 Flash Preview 10.0 10.0 100.0% 0 3.35s 234 0
OpenAI: GPT-5.4 10.0 10.0 100.0% 0 13.28s 264 1,031

Comparación rápida

Cambiar par de comparación