AI BENCHY Compare

ByteDance Seed: Seed-2.0-Lite vs Google: Gemini 3.5 Flash

Resumen

Comparación benchmark de Seed-2.0-Lite vs Gemini 3.5 Flash: Gemini 3.5 Flash lidera en puntuación media con 9.6 vs 5.8. Seed-2.0-Lite tiene menor coste de benchmark con $0.019 vs $1.115. Seed-2.0-Lite es más rápido con 2.49s vs 8.84s, con tasas de acierto de 46.0% vs 96.8%.

Modelo recomendado: Gemini 3.5 Flash - Tiene la puntuación más alta en esta comparación (9.6) y el mejor equilibrio general entre coste y tiempo de respuesta en los 2 modelos.

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-06-10

Métrica	Seed-2.0-Lite Seed-2.0-Lite none Lanzamiento: 2026-02-14	Gemini 3.5 Flash Gemini 3.5 Flash high Lanzamiento: 2026-05-19

Métrica	Seed-2.0-Lite Seed-2.0-Lite none Lanzamiento: 2026-02-14	Gemini 3.5 Flash Gemini 3.5 Flash high Lanzamiento: 2026-05-19
Puntuación	5.8	9.6
Rango	#111	#2
Fiabilidad	10.0	10.0
Consistencia	8.4	9.6
Pruebas correctas
Tasa de aciertos por intento	46.0%	96.8%
Pruebas inestables	4	1
Ejecuciones totales	63	63
Costo por resultado	0.228	5.575
Costo total	$0.019	$1.115
Precio de entrada	$0.250 / 1M	$1.500 / 1M
Precio de salida	$2.000 / 1M	$9.000 / 1M
Total de tokens de entrada	46,573	37,594
Tokens de salida	3,259	1,975
Tokens de razonamiento	0	115,638
Tiempo de respuesta (promedio)	2.49s	8.84s
Tiempo de respuesta (máximo)	6.70s	34.82s
Tiempo de respuesta (total)	52.26s	185.57s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#111 Seed-2.0-Lite

none

Cost: $0.005
Time: 83.8s
Tokens: 2,311 tok

#2 Gemini 3.5 Flash

high

Cost: $0.208
Time: 118.2s
Tokens: 23,158 tok

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Trucos anti-IA	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Seed-2.0-Lite	3.0	5.9	16.7%	2		2.43s	894	709	0
Gemini 3.5 Flash	10.0	10.0	100.0%	0		2.57s	492	174	4,997

Programación	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Seed-2.0-Lite	5.6	10.0	33.3%	0		2.83s	8,215	410	0
Gemini 3.5 Flash	10.0	10.0	100.0%	0		22.96s	8,118	456	47,129

Combinado	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Seed-2.0-Lite	3.0	10.0	0.0%	0		6.59s	16,215	498	0
Gemini 3.5 Flash	10.0	10.0	100.0%	0		22.37s	12,873	351	16,323

Análisis y extracción de datos	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Seed-2.0-Lite	10.0	10.0	100.0%	0		1.82s	8,538	246	0
Gemini 3.5 Flash	10.0	10.0	100.0%	0		6.43s	7,548	279	8,466

Específico del dominio	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Seed-2.0-Lite	3.6	7.2	22.2%	1		1.33s	939	17	0
Gemini 3.5 Flash	7.6	7.2	77.8%	1		14.09s	633	12	24,721

Inteligencia general	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Seed-2.0-Lite	10.0	10.0	100.0%	0		3.45s	570	294	0
Gemini 3.5 Flash	10.0	10.0	100.0%	0		3.63s	486	115	1,650

Seguimiento de instrucciones	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Seed-2.0-Lite	10.0	10.0	100.0%	0		1.06s	810	73	0
Gemini 3.5 Flash	10.0	10.0	100.0%	0		3.35s	615	70	3,799

Resolución de acertijos	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Seed-2.0-Lite	5.3	7.2	44.4%	1		2.78s	858	709	0
Gemini 3.5 Flash	10.0	10.0	100.0%	0		3.23s	558	241	4,940

Llamada de herramientas	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Seed-2.0-Lite	10.0	10.0	100.0%	0		3.94s	9,270	292	0
Gemini 3.5 Flash	9.8	10.0	100.0%	0		4.96s	6,115	265	1,608

Cultura general	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Seed-2.0-Lite	3.0	10.0	0.0%	0		1.96s	264	11	0
Gemini 3.5 Flash	10.0	10.0	100.0%	0		3.94s	156	12	2,005

Comparación rápida

Cambiar par de comparación

Seed-2.0-LitenonevsNemotron 3 SupermediumDisponible gratis CobuddymediumvsSeed-2.0-Litenone Seed-2.0-LitenonevsDeepSeek V4 Prohigh Seed-2.0-Litenonevsgpt-oss-120bmediumDisponible gratis Seed-2.0-LitenonevsMiniMax M2.5medium Seed-2.0-LitenonevsMiniMax M2.7medium Seed-2.0-LitenonevsMistral Small 4medium Gemini 3.5 FlashhighvsQwen3.7 Maxmedium Seed-2.0-LitenonevsGPT-5 Nanomedium Gemini 3.5 FlashhighvsGPT-5.5low Seed-2.0-LitenonevsGemini 3.1 Flash Liteminimal Gemini 3.5 FlashhighvsGPT-5.5medium