AI BENCHY Compare

ByteDance Seed: Seed-2.0-Lite vs Google: Gemini 3.1 Flash Lite

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-05-22

Metrică	Seed-2.0-Lite Seed-2.0-Lite medium Lansare: 2026-02-14	Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite high Lansare: 2026-05-08

Metrică	Seed-2.0-Lite Seed-2.0-Lite medium Lansare: 2026-02-14	Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite high Lansare: 2026-05-08
Scor	8.1	7.5
Rang	#21	#48
Fiabilitate	10.0	9.8
Consistență	8.9	8.1
Teste corecte
Rată de trecere pe încercare	75.0%	74.1%
Teste instabile	3	4
Rulări totale	60	54
Cost per rezultat	1.170	18.579
Cost total	$0.153	$2.044
Preț de intrare	$0.250 / 1M	$0.250 / 1M
Preț de ieșire	$2.000 / 1M	$1.500 / 1M
Tokenuri de ieșire	3,282	1,984
Tokenuri de raționament	67,287	1,355,583
Timp de răspuns (mediu)	36.79s	61.96s
Timp de răspuns (maxim)	168.71s	149.23s
Timp de răspuns (total)	735.86s	1115.31s

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Seed-2.0-Lite	8.3	10.0	75.0%	0		17.99s	996	7,142
Gemini 3.1 Flash Lite	9.4	10.0	100.0%	0		37.16s	100	130,598

Programare	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Seed-2.0-Lite	7.0	9.7	50.0%	0		107.65s	452	20,524
Gemini 3.1 Flash Lite	10.0	10.0	100.0%	0		137.63s	666	188,733

Combinat	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Seed-2.0-Lite	10.0	10.0	100.0%	0		37.67s	506	4,299
Gemini 3.1 Flash Lite	10.0	10.0	100.0%	0		149.23s	327	198,243

Parsare și extragere de date	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Seed-2.0-Lite	10.0	10.0	100.0%	0		9.07s	246	1,742
Gemini 3.1 Flash Lite	10.0	10.0	100.0%	0		4.49s	279	7,351

Specific domeniului	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Seed-2.0-Lite	5.9	7.2	55.6%	1		88.74s	15	23,897
Gemini 3.1 Flash Lite	3.6	7.2	22.2%	1		139.90s	18	566,210

Inteligență generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Seed-2.0-Lite	6.7	3.6	66.7%	1		18.25s	304	1,620
Gemini 3.1 Flash Lite	5.0	2.1	66.7%	1		45.69s	95	64,644

Respectarea instrucțiunilor	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Seed-2.0-Lite	10.0	10.0	100.0%	0		7.26s	71	1,480
Gemini 3.1 Flash Lite	7.3	5.8	83.3%	1		23.26s	52	3,549

Rezolvare de puzzle-uri	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Seed-2.0-Lite	9.0	7.9	88.9%	1		11.03s	461	3,532
Gemini 3.1 Flash Lite	5.7	6.8	44.4%	1		50.83s	213	193,654

Apelare instrumente	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Seed-2.0-Lite	10.0	10.0	100.0%	0		12.38s	222	1,011
Gemini 3.1 Flash Lite	10.0	10.0	100.0%	0		6.44s	234	2,601

Cultură generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Seed-2.0-Lite	3.0	10.0	0.0%	0		48.32s	9	2,040
Gemini 3.1 Flash Lite	-	-	-	-	-	-	-	-

Comparație rapidă

Schimbă perechea de comparație

Seed-2.0-LitemediumvsGemini 3.5 Flashminimal Seed-2.0-LitemediumvsQwen3.7 Maxnone Seed-2.0-LitemediumvsGemini 3 Flash Previewnone Seed-2.0-LitemediumvsGemini 3.1 Flash Lite Previewlow Seed-2.0-LitemediumvsGPT-5.2 Chatnone Seed-2.0-LitemediumvsGemini 3 Flash Previewlow Seed-2.0-LitemediumvsGemini 3.1 Flash Lite Previewnone Seed-2.0-LitemediumvsGemini 3.1 Flash Litelow Seed-2.0-LitemediumvsGPT-5.3 Chatnone Seed-2.0-LitemediumvsDeepSeek V4 FlashhighDisponibil gratuit Seed-2.0-LitemediumvsRing-2.6-1Tnone Seed-2.0-LitemediumvsGemini 3.5 Flashnone