Navegación
AI BENCHY
Advertise here

AI BENCHY Compare

Google: Gemini 3.5 Flash vs OpenAI: gpt-oss-120b

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-05-19

Métrica Gemini 3.5 Flash Gemini 3.5 Flash low Lanzamiento: 2026-05-19 gpt-oss-120b gpt-oss-120b medium Lanzamiento: 2025-08-05 Disponible gratis
Puntuación 9.6 5.7
Rango #2 #106
Fiabilidad 10.0 10.0
Consistencia 10.0 7.4
Pruebas correctas
Tasa de aciertos por intento 94.7% 49.1%
Pruebas inestables 0 6
Ejecuciones totales 57 57
Costo por resultado 1.359 0.152
Costo total $0.245 $0.011
Precio de entrada $1.500 / 1M $0.000 / 1M
Precio de salida $9.000 / 1M $0.000 / 1M
Tokens de salida 2,003 16,594
Tokens de razonamiento 20,245 40,637
Tiempo de respuesta (promedio) 2.84s 16.95s
Tiempo de respuesta (máximo) 6.44s 50.92s
Tiempo de respuesta (total) 54.00s 203.39s

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Trucos anti-IA Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.52s 209 2,536
gpt-oss-120b 6.7 9.9 50.0% 0 10.21s 3,518 2,177
Programación Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 3.5 Flash 10.0 10.0 100.0% 0 5.49s 428 3,146
gpt-oss-120b 4.3 1.1 66.7% 1 26.33s 228 2,549
Combinado Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 3.5 Flash 10.0 10.0 100.0% 0 6.44s 351 3,050
gpt-oss-120b 10.0 10.0 100.0% 0 31.18s 694 5,072
Análisis y extracción de datos Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 3.5 Flash 10.0 10.0 100.0% 0 1.81s 279 1,164
gpt-oss-120b 6.4 5.9 66.7% 1 1.98s 241 1,114
Específico del dominio Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 3.5 Flash 7.7 10.0 66.7% 0 3.39s 12 4,538
gpt-oss-120b 2.9 4.4 22.2% 2 50.92s 6,784 20,606
Inteligencia general Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.27s 119 916
gpt-oss-120b 4.3 10.0 0.0% 0 7.90s 107 387
Seguimiento de instrucciones Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 3.5 Flash 9.9 10.0 100.0% 0 1.86s 71 1,652
gpt-oss-120b 9.9 10.0 100.0% 0 7.63s 126 1,799
Resolución de acertijos Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.35s 288 2,150
gpt-oss-120b 3.2 4.7 22.2% 2 11.80s 1,508 2,092
Llamada de herramientas Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.27s 234 403
gpt-oss-120b 9.8 10.0 100.0% 0 6.91s 287 1,083
Cultura general Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de salida Tokens de razonamiento
Gemini 3.5 Flash 10.0 10.0 100.0% 0 1.88s 12 690
gpt-oss-120b 3.0 10.0 0.0% 0 26.51s 3,101 3,758

Comparación rápida

Cambiar par de comparación