ByteDance Seed: Seed-2.0-Lite vs OpenAI: GPT-5.5

GPT-5.5 (low) unggul dalam skor rata-rata dengan 9.3 vs 7.9. Seed-2.0-Lite (medium) memiliki biaya benchmark lebih rendah di $0.234 vs $1.253. GPT-5.5 (low) lebih cepat di 10.13s vs 48.53s, dengan tingkat keberhasilan 74.2% vs 86.4%.

Model yang direkomendasikanGPT-5.5 (low)It has the best score here (9.3), while responding about 4.8x faster than Seed-2.0-Lite (medium).

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-07-25

Metrik	Seed-2.0-Lite Seed-2.0-Lite medium Rilis: 2026-02-14	GPT-5.5 GPT-5.5 low Rilis: 2026-04-24

Metrik	Seed-2.0-Lite Seed-2.0-Lite medium Rilis: 2026-02-14	GPT-5.5 GPT-5.5 low Rilis: 2026-04-24
Skor	7.9	9.3
Peringkat	#42	#9
Keandalan	10.0	10.0
Konsistensi	8.6	10.0
Tes benar
Tingkat lulus per percobaan	74.2%	86.4%
Tes tidak stabil	4	0
Total Run	66	66
Biaya per hasil	1.669	6.594
Total Biaya	$0.234	$1.253
Harga input	$0.250 / 1M	$5.000 / 1M
Harga output	$2.000 / 1M	$30.000 / 1M
Total token input	129,897	80,058
Token output	12,533	5,378
Token penalaran	88,047	23,040
Waktu respons (rata-rata)	48.53s	10.13s
Waktu respons (maks)	254.92s	56.19s
Waktu respons (total)	1067.74s	222.82s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#42 Seed-2.0-Lite

medium

Biaya: $0.005
Waktu: 86.7s
Token: 2,354 tok

#9 GPT-5.5

low

Biaya: $0.068
Waktu: 37.0s
Token: 2,339 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Kategori:

Trik anti-AI	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token input	Token output	Token penalaran
Seed-2.0-Lite	8.3	10.0	75.0%	0		17.99s	942	996	7,142
GPT-5.5	10.0	10.0	100.0%	0		4.41s	606	238	1,020

Pemrograman	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token input	Token output	Token penalaran
Seed-2.0-Lite	8.0	9.8	66.7%	0		156.74s	8,247	458	31,890
GPT-5.5	10.0	10.0	100.0%	0		15.04s	7,302	423	6,402

Gabungan	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token input	Token output	Token penalaran
Seed-2.0-Lite	6.4	5.8	66.7%	1		58.52s	99,411	9,809	13,940
GPT-5.5	10.0	10.0	100.0%	0		13.73s	56,868	3,635	1,297

Parsing dan ekstraksi data	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token input	Token output	Token penalaran
Seed-2.0-Lite	10.0	10.0	100.0%	0		9.07s	8,562	246	1,742
GPT-5.5	10.0	10.0	100.0%	0		3.28s	7,140	228	157

Spesifik domain	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token input	Token output	Token penalaran
Seed-2.0-Lite	5.9	7.2	55.6%	1		88.74s	843	15	23,897
GPT-5.5	5.3	10.0	33.3%	0		28.05s	723	69	11,609

Kecerdasan umum	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token input	Token output	Token penalaran
Seed-2.0-Lite	6.7	3.6	66.7%	1		18.25s	582	304	1,620
GPT-5.5	10.0	10.0	100.0%	0		5.17s	477	133	245

Kepatuhan instruksi	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token input	Token output	Token penalaran
Seed-2.0-Lite	10.0	10.0	100.0%	0		7.26s	834	71	1,480
GPT-5.5	9.9	10.0	100.0%	0		3.74s	660	93	415

Pemecahan teka-teki	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token input	Token output	Token penalaran
Seed-2.0-Lite	9.0	7.9	88.9%	1		10.23s	894	403	3,285
GPT-5.5	10.0	10.0	100.0%	0		4.74s	642	279	954

Pemanggilan alat	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token input	Token output	Token penalaran
Seed-2.0-Lite	10.0	10.0	100.0%	0		12.38s	9,306	222	1,011
GPT-5.5	10.0	10.0	100.0%	0		4.96s	5,445	250	101

Pengetahuan umum	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token input	Token output	Token penalaran
Seed-2.0-Lite	3.0	10.0	0.0%	0		48.32s	276	9	2,040
GPT-5.5	3.0	10.0	0.0%	0		10.06s	195	30	840

Perbandingan Cepat

Ganti Pasangan Perbandingan

Seed-2.0-LitemediumvsGPT-5.6 Terrahigh Seed-2.0-LitemediumvsKimi K3max Gemini 3.1 Pro PreviewmediumvsGPT-5.5low Claude Opus 5highvsGPT-5.5low Claude Opus 5mediumvsGPT-5.5low Claude Opus 4.8lowvsSeed-2.0-Litemedium Seed-2.0-LitemediumvsGLM 5.2high Seed-2.0-LitemediumvsGPT-5.2 Chatnone Seed-2.0-LitemediumvsInklinghigh Seed-2.0-LitemediumvsGemini 3.5 Flash-Litehigh GPT-5.5lowvsQwen3.7 Maxmedium Seed-2.0-LitemediumvsMuse Spark 1.1high