Navegación
AI BENCHY
Your ad here

AI BENCHY Compare

Google: Gemini 2.5 Flash vs OpenAI: GPT-5.4 Mini

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-03-17

Métrica Gemini 2.5 Flash Gemini 2.5 Flash none Lanzamiento: 2025-06-17 GPT-5.4 Mini GPT-5.4 Mini medium Lanzamiento: 2026-03-17
Rango #48 #34
Puntuación 5.9 7.1
Consistencia 9.1 7.2
Costo por resultado 0.192 3.610
Costo total $0.012 $0.289
Pruebas correctas
Tasa de aciertos por intento 41.2% 68.6%
Pruebas inestables 2 6
Ejecuciones totales 51 51
Tokens de salida 1,273 1,708
Tokens de razonamiento 0 58,019
Tiempo de respuesta (promedio) 888ms 15.66s
Tiempo de respuesta (máximo) 4.39s 102.91s
Tiempo de respuesta (total) 15.10s 266.14s

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Trucos anti-IA Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 2.5 Flash 3.0 10.0 0.0% 0 582ms 102 0
GPT-5.4 Mini 8.6 7.9 91.7% 1 4.05s 296 2,876
Combinado Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 2.5 Flash 3.0 10.0 0.0% 0 4.39s 366 0
GPT-5.4 Mini 10.0 10.0 100.0% 0 17.81s 317 4,317
Análisis y extracción de datos Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 2.5 Flash 10.0 10.0 100.0% 0 652ms 279 0
GPT-5.4 Mini 10.0 10.0 100.0% 0 2.43s 234 650
Específico del dominio Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 2.5 Flash 5.9 7.2 55.6% 1 495ms 12 0
GPT-5.4 Mini 4.1 4.4 44.5% 2 65.31s 60 43,286
Inteligencia general Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 2.5 Flash 5.0 10.0 0.0% 0 615ms 78 0
GPT-5.4 Mini 4.5 10.0 0.0% 0 3.72s 150 510
Seguimiento de instrucciones Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 2.5 Flash 8.0 6.8 66.7% 1 672ms 70 0
GPT-5.4 Mini 7.4 6.5 66.7% 1 2.50s 129 1,337
Puzzle Solving Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 2.5 Flash 5.7 10.0 33.3% 0 576ms 132 0
GPT-5.4 Mini 6.8 7.9 55.6% 1 4.33s 271 2,449
Llamada de herramientas Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 2.5 Flash 10.0 10.0 100.0% 0 1.91s 234 0
GPT-5.4 Mini 4.7 1.6 66.7% 1 9.62s 251 2,594

Comparación rápida

Cambiar par de comparación