AI BENCHY Compare

ByteDance Seed: Seed-2.0-Lite vs Google: Gemma 4 31B

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-04-02

Metrică	Seed-2.0-Lite Seed-2.0-Lite medium Lansare: 2026-02-14	Gemma 4 31B Gemma 4 31B medium Lansare: 2026-04-02

Metrică	Seed-2.0-Lite Seed-2.0-Lite medium Lansare: 2026-02-14	Gemma 4 31B Gemma 4 31B medium Lansare: 2026-04-02
Scor	8.5	8.6
Rang	#6	#5
Consistență	8.8	9.6
Teste corecte
Rată de trecere pe încercare	82.4%	80.4%
Teste instabile	3	1
Rulări totale	51	51
Cost per rezultat	0.873	0.109
Cost total	$0.105	$0.015
Preț de intrare	$0.250 / 1M	$0.140 / 1M
Preț de ieșire	$2.000 / 1M	$0.400 / 1M
Tokenuri de ieșire	2,821	9,568
Tokenuri de raționament	44,723	22,501
Timp de răspuns (mediu)	27.78s	21.81s
Timp de răspuns (maxim)	168.71s	68.92s
Timp de răspuns (total)	472.24s	327.16s

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Seed-2.0-Lite	8.3	10.0	75.0%	0		17.99s	996	7,142
Gemma 4 31B	10.0	10.0	100.0%	0		12.89s	962	2,046

Combinat	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Seed-2.0-Lite	10.0	10.0	100.0%	0		37.67s	506	4,299
Gemma 4 31B	3.0	10.0	0.0%	0		0ms	0	0

Parsare și extragere de date	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Seed-2.0-Lite	10.0	10.0	100.0%	0		9.07s	246	1,742
Gemma 4 31B	10.0	10.0	100.0%	0		21.11s	1,822	2,951

Specific domeniului	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Seed-2.0-Lite	5.9	7.2	55.6%	1		88.74s	15	23,897
Gemma 4 31B	7.7	10.0	66.7%	0		38.48s	4,349	8,985

Inteligență generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Seed-2.0-Lite	6.7	3.6	66.7%	1		18.25s	304	1,620
Gemma 4 31B	10.0	10.0	100.0%	0		9.57s	105	888

Respectarea instrucțiunilor	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Seed-2.0-Lite	10.0	10.0	100.0%	0		7.26s	71	1,480
Gemma 4 31B	10.0	10.0	100.0%	0		12.76s	533	2,035

Puzzle Solving	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Seed-2.0-Lite	9.0	7.9	88.9%	1		11.03s	461	3,532
Gemma 4 31B	8.8	7.9	88.9%	1		27.63s	1,797	5,596

Apelare instrumente	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Seed-2.0-Lite	10.0	10.0	100.0%	0		12.38s	222	1,011
Gemma 4 31B	3.0	10.0	0.0%	0		0ms	0	0

Comparație rapidă

Schimbă perechea de comparație

Seed-2.0-LitemediumvsGemini 3 Flash Previewlow Seed-2.0-LitemediumvsGemini 3.1 Flash Lite Previewlow Seed-2.0-LitemediumvsGemini 3 Flash Previewnone Seed-2.0-LitemediumvsGemini 3.1 Flash Lite Previewnone Seed-2.0-LitemediumvsGPT-5.2 Chatnone Gemma 4 31BmediumvsGPT-5.2 Chatnone Seed-2.0-LitemediumvsGPT-5.3 Chatnone Gemma 4 31BmediumvsGPT-5.3 Chatnone Claude Sonnet 4.6nonevsSeed-2.0-Litemedium Claude Sonnet 4.6nonevsGemma 4 31Bmedium Seed-2.0-LitemediumvsQwen3.5 Plus 2026-02-15none Seed-2.0-LitemediumvsGemma 4 31Bnone