Navegación
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Gemini 3.5 Flash Lite (medium) vs GPT-5.6 Terra (high)

GPT-5.6 Terra (high) lidera en puntuación media con 8.0 vs 7.8. Gemini 3.5 Flash Lite (medium) tiene menor coste de benchmark con $0.273 vs $0.422. Gemini 3.5 Flash Lite (medium) es más rápido con 5.20s vs 11.32s, con tasas de acierto de 78.8% vs 68.2%.

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-08-11

Rango
#54
Total de tokens de salida
96,653
Tiempo de respuesta (promedio)
5.20s
Costo total
$0.273
Rango
#50
Total de tokens de salida
56,791
Tiempo de respuesta (promedio)
11.32s
Costo total
$0.422
Modelo recomendado Gemini 3.5 Flash Lite (medium)

Su puntuación se mantiene cerca de la mejor aquí (7.8 vs 8.0) y cuesta aproximadamente 1.5x menos que GPT-5.6 Terra (high).

Comparación detallada

Métrica Gemini 3.5 Flash Lite Gemini 3.5 Flash Lite medium Lanzamiento: 2026-07-21 GPT-5.6 Terra GPT-5.6 Terra high Lanzamiento: 2026-07-09
Puntuación 7.8 8.0
Rango #54 #50
Fiabilidad 10.0 10.0
Consistencia 7.8 9.3
Cobertura del benchmark 22/22 pruebas · 66/66 intentos 22/22 pruebas · 66/66 intentos
Pruebas correctas
Tasa de aciertos por intento 78.8% 68.2%
Pruebas inestables 6 2
Ejecuciones totales 66 66
Costo por resultado 1.949 7.533
Costo total $0.273 $0.422
Precio de entrada $0.300 / 1M $1.000 / 1M
Precio de salida $2.500 / 1M $6.000 / 1M
Total de tokens de entrada 103,903 81,047
Tokens de salida 8,892 5,055
Tokens de razonamiento 87,761 51,736
Tiempo de respuesta (promedio) 5.20s 11.32s
Tiempo de respuesta (máximo) 26.41s 91.49s
Tiempo de respuesta (total) 114.46s 249.14s

Generación showcase de modelos

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#54 Gemini 3.5 Flash Lite

medium
Coste
$0.010
Tiempo
17.8s
Tokens
4,000 tok

#50 GPT-5.6 Terra

high
Coste
$0.055
Tiempo
30.2s
Tokens
3,748 tok

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Programación Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
Gemini 3.5 Flash Lite 7.9 9.9 66.7% 0 9.96s 8,122 471 28,930
GPT-5.6 Terra 7.6 7.2 77.8% 1 9.14s 7,302 370 6,087

Comparación rápida

Cambiar par de comparación