AI BENCHY Compare

ByteDance Seed: Seed-2.0-Lite vs Google: Gemma 4 26B A4B

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-04-04

Metrică	Seed-2.0-Lite Seed-2.0-Lite medium Lansare: 2026-02-14	Gemma 4 26B A4B Gemma 4 26B A4B medium Lansare: 2026-04-03

Metrică	Seed-2.0-Lite Seed-2.0-Lite medium Lansare: 2026-02-14	Gemma 4 26B A4B Gemma 4 26B A4B medium Lansare: 2026-04-03
Scor	8.5	8.3
Rang	#6	#13
Consistență	8.8	8.9
Teste corecte
Rată de trecere pe încercare	82.4%	80.4%
Teste instabile	3	2
Rulări totale	51	51
Cost per rezultat	0.873	0.189
Cost total	$0.105	$0.025
Preț de intrare	$0.250 / 1M	$0.130 / 1M
Preț de ieșire	$2.000 / 1M	$0.400 / 1M
Tokenuri de ieșire	2,821	12,412
Tokenuri de raționament	44,723	39,955
Timp de răspuns (mediu)	27.78s	17.38s
Timp de răspuns (maxim)	168.71s	73.55s
Timp de răspuns (total)	472.24s	278.01s

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Seed-2.0-Lite	8.3	10.0	75.0%	0		17.99s	996	7,142
Gemma 4 26B A4B	10.0	10.0	100.0%	0		6.20s	1,142	3,045

Combinat	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Seed-2.0-Lite	10.0	10.0	100.0%	0		37.67s	506	4,299
Gemma 4 26B A4B	9.6	10.0	100.0%	0		73.55s	5,415	13,112

Parsare și extragere de date	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Seed-2.0-Lite	10.0	10.0	100.0%	0		9.07s	246	1,742
Gemma 4 26B A4B	10.0	10.0	100.0%	0		16.51s	1,567	2,827

Specific domeniului	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Seed-2.0-Lite	5.9	7.2	55.6%	1		88.74s	15	23,897
Gemma 4 26B A4B	2.9	4.4	22.2%	2		23.62s	2,469	7,105

Inteligență generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Seed-2.0-Lite	6.7	3.6	66.7%	1		18.25s	304	1,620
Gemma 4 26B A4B	10.0	10.0	100.0%	0		29.76s	25	5,075

Respectarea instrucțiunilor	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Seed-2.0-Lite	10.0	10.0	100.0%	0		7.26s	71	1,480
Gemma 4 26B A4B	10.0	10.0	100.0%	0		17.54s	887	4,470

Puzzle Solving	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Seed-2.0-Lite	9.0	7.9	88.9%	1		11.03s	461	3,532
Gemma 4 26B A4B	7.9	9.6	66.7%	0		8.52s	457	3,065

Apelare instrumente	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Seed-2.0-Lite	10.0	10.0	100.0%	0		12.38s	222	1,011
Gemma 4 26B A4B	10.0	10.0	100.0%	0		9.01s	450	1,256

Comparație rapidă

Schimbă perechea de comparație

Seed-2.0-LitemediumvsGemini 3 Flash Previewlow Seed-2.0-LitemediumvsGemini 3.1 Flash Lite Previewlow Seed-2.0-LitemediumvsGemini 3 Flash Previewnone Gemma 4 26B A4BmediumvsGPT-5.2 Chatnone Seed-2.0-LitemediumvsGemini 3.1 Flash Lite Previewnone Seed-2.0-LitemediumvsGPT-5.2 Chatnone Gemma 4 26B A4BmediumvsGPT-5.3 Chatnone Seed-2.0-LitemediumvsGPT-5.3 Chatnone Claude Sonnet 4.6nonevsGemma 4 26B A4Bmedium Claude Sonnet 4.6nonevsSeed-2.0-Litemedium Gemma 4 26B A4BmediumvsQwen3.5 Plus 2026-02-15none Gemma 4 26B A4BmediumvsGLM 5none