Navegación
AI BENCHY
Advertise here

AI BENCHY Compare

Anthropic: Claude Sonnet 5 vs Google: Gemini 3.5 Flash

Resumen

Comparación benchmark de Claude Sonnet 5 vs Gemini 3.5 Flash: Claude Sonnet 5 lidera en puntuación media con 7.9 vs 7.0. Claude Sonnet 5 tiene menor coste de benchmark con $0.550 vs $1.079. Gemini 3.5 Flash es más rápido con 9.93s vs 9.94s, con tasas de acierto de 79.4% vs 77.8%.

Modelo recomendado: Claude Sonnet 5 - Tiene la mejor puntuación aquí (7.9) y cuesta aproximadamente 2.0x menos que Gemini 3.5 Flash.

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-06-30

Métrica Claude Sonnet 5 Claude Sonnet 5 medium Lanzamiento: 2026-06-30 Gemini 3.5 Flash Gemini 3.5 Flash none Lanzamiento: 2026-05-19
Puntuación 7.9 7.0
Rango #30 #68
Fiabilidad 10.0 10.0
Consistencia 9.0 8.9
Pruebas correctas
Tasa de aciertos por intento 79.4% 77.8%
Pruebas inestables 3 3
Ejecuciones totales 63 63
Costo por resultado 3.662 7.190
Costo total $0.550 $1.079
Precio de entrada $2.000 / 1M $1.500 / 1M
Precio de salida $10.000 / 1M $9.000 / 1M
Total de tokens de entrada 67,416 13,843
Tokens de salida 34,012 117,518
Tokens de razonamiento 7,673 0
Tiempo de respuesta (promedio) 9.94s 9.93s
Tiempo de respuesta (máximo) 56.94s 64.36s
Tiempo de respuesta (total) 208.71s 178.68s

Generación showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#30 Claude Sonnet 5

medium
Coste
$0.007
Tiempo
6.4s
Tokens
832 tok

#68 Gemini 3.5 Flash

none
Coste
$0.225
Tiempo
125.5s
Tokens
25,004 tok

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Trucos anti-IA Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
Claude Sonnet 5 10.0 10.0 100.0% 0 3.80s 834 1,220 446
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.53s 492 5,101 0
Programación Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
Claude Sonnet 5 9.0 7.9 88.9% 1 17.28s 10,590 13,153 2,379
Gemini 3.5 Flash 8.8 7.8 88.9% 1 34.69s 8,122 75,927 0
Combinado Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
Claude Sonnet 5 4.5 2.1 66.7% 1 37.01s 29,394 4,848 2,170
Gemini 3.5 Flash 3.0 10.0 0.0% 0 0ms 0 0 0
Análisis y extracción de datos Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
Claude Sonnet 5 10.0 10.0 100.0% 0 3.16s 10,503 312 0
Gemini 3.5 Flash 6.5 10.0 50.0% 0 8.10s 2,781 5,895 0
Específico del dominio Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
Claude Sonnet 5 7.7 10.0 66.7% 0 20.38s 975 12,140 1,994
Gemini 3.5 Flash 7.6 7.2 77.8% 1 10.64s 633 17,910 0
Inteligencia general Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
Claude Sonnet 5 4.8 3.2 33.3% 1 4.32s 708 264 0
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.46s 486 1,620 0
Seguimiento de instrucciones Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
Claude Sonnet 5 9.9 10.0 100.0% 0 3.10s 909 318 269
Gemini 3.5 Flash 9.8 10.0 100.0% 0 3.38s 615 3,928 0
Resolución de acertijos Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
Claude Sonnet 5 7.7 10.0 66.7% 0 2.98s 894 407 121
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.13s 558 4,640 0
Llamada de herramientas Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
Claude Sonnet 5 10.0 10.0 100.0% 0 10.70s 12,351 433 90
Gemini 3.5 Flash 3.0 10.0 0.0% 0 0ms 0 0 0
Cultura general Puntuación Consistencia Tasa de aciertos por intento Pruebas inestables Pruebas correctas Tiempo de respuesta (promedio) Tokens de entrada Tokens de salida Tokens de razonamiento
Claude Sonnet 5 3.0 10.0 0.0% 0 7.06s 258 917 204
Gemini 3.5 Flash 2.8 1.6 33.3% 1 4.87s 156 2,497 0

Comparación rápida

Cambiar par de comparación