AI BENCHY Compare

ByteDance Seed: Seed-2.0-Lite vs Google: Gemini 3 Flash Preview

Resumen

Comparación benchmark de Seed-2.0-Lite vs Gemini 3 Flash Preview: Gemini 3 Flash Preview lidera en puntuación media con 9.8 vs 5.8. Seed-2.0-Lite tiene menor coste de benchmark con $0.019 vs $0.667. Seed-2.0-Lite es más rápido con 2.49s vs 18.64s, con tasas de acierto de 46.0% vs 98.4%.

Modelo recomendado: Gemini 3 Flash Preview - Tiene la puntuación más alta en esta comparación (9.8) y el mejor equilibrio general entre coste y tiempo de respuesta en los 2 modelos.

Benchmarks generados a partir de los suites de prueba de AI BENCHY en: 2026-06-10

Métrica	Seed-2.0-Lite Seed-2.0-Lite none Lanzamiento: 2026-02-14	Gemini 3 Flash Preview Gemini 3 Flash Preview medium Lanzamiento: 2025-12-17

Métrica	Seed-2.0-Lite Seed-2.0-Lite none Lanzamiento: 2026-02-14	Gemini 3 Flash Preview Gemini 3 Flash Preview medium Lanzamiento: 2025-12-17
Puntuación	5.8	9.8
Rango	#111	#1
Fiabilidad	10.0	10.0
Consistencia	8.4	9.7
Pruebas correctas
Tasa de aciertos por intento	46.0%	98.4%
Pruebas inestables	4	1
Ejecuciones totales	63	63
Costo por resultado	0.228	3.335
Costo total	$0.019	$0.667
Precio de entrada	$0.250 / 1M	$0.500 / 1M
Precio de salida	$2.000 / 1M	$3.000 / 1M
Total de tokens de entrada	46,573	37,017
Tokens de salida	3,259	2,006
Tokens de razonamiento	0	214,153
Tiempo de respuesta (promedio)	2.49s	18.64s
Tiempo de respuesta (máximo)	6.70s	117.26s
Tiempo de respuesta (total)	52.26s	391.35s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#111 Seed-2.0-Lite

none

Cost: $0.005
Time: 83.8s
Tokens: 2,311 tok

#1 Gemini 3 Flash Preview

medium

Cost: $0.010
Time: 17.9s
Tokens: 3,236 tok

Mejores modelos por puntuación

Puntuación vs costo total

Tiempo de respuesta (promedio)

Puntuación vs Tiempo de respuesta (promedio)

Total de tokens de salida

Puntuación vs Total de tokens de salida

Desglose por categoría

Trucos anti-IA	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Seed-2.0-Lite	3.0	5.9	16.7%	2		2.43s	894	709	0
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		3.88s	494	330	3,216

Programación	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Seed-2.0-Lite	5.6	10.0	33.3%	0		2.83s	8,215	410	0
Gemini 3 Flash Preview	8.6	7.6	88.9%	1		84.40s	8,122	462	161,084

Combinado	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Seed-2.0-Lite	3.0	10.0	0.0%	0		6.59s	16,215	498	0
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		22.42s	12,873	351	10,485

Análisis y extracción de datos	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Seed-2.0-Lite	10.0	10.0	100.0%	0		1.82s	8,538	246	0
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		5.43s	7,548	279	4,893

Específico del dominio	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Seed-2.0-Lite	3.6	7.2	22.2%	1		1.33s	939	17	0
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		15.27s	633	12	21,684

Inteligencia general	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Seed-2.0-Lite	10.0	10.0	100.0%	0		3.45s	570	294	0
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		5.19s	486	72	1,905

Seguimiento de instrucciones	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Seed-2.0-Lite	10.0	10.0	100.0%	0		1.06s	810	73	0
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		4.04s	615	72	2,709

Resolución de acertijos	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Seed-2.0-Lite	5.3	7.2	44.4%	1		2.78s	858	709	0
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		4.05s	558	183	4,365

Llamada de herramientas	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Seed-2.0-Lite	10.0	10.0	100.0%	0		3.94s	9,270	292	0
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		12.60s	5,532	234	1,487

Cultura general	Puntuación	Consistencia	Tasa de aciertos por intento	Pruebas inestables	Pruebas correctas	Tiempo de respuesta (promedio)	Tokens de entrada	Tokens de salida	Tokens de razonamiento
Seed-2.0-Lite	3.0	10.0	0.0%	0		1.96s	264	11	0
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		5.50s	156	11	2,325

Comparación rápida

Cambiar par de comparación

Seed-2.0-LitenonevsNemotron 3 SupermediumDisponible gratis CobuddymediumvsSeed-2.0-Litenone Seed-2.0-LitenonevsDeepSeek V4 Prohigh Seed-2.0-Litenonevsgpt-oss-120bmediumDisponible gratis Seed-2.0-LitenonevsMiniMax M2.5medium Seed-2.0-LitenonevsMiniMax M2.7medium Seed-2.0-LitenonevsMistral Small 4medium Seed-2.0-LitenonevsGPT-5 Nanomedium Seed-2.0-LitenonevsGemini 3.1 Flash Liteminimal Gemini 3 Flash PreviewmediumvsGPT-5.5low Seed-2.0-LitenonevsMercury 2medium Seed-2.0-LitenonevsQwen3.6 27Bmedium