AI BENCHY Compare

ByteDance Seed: Seed-2.0-Lite vs Gemini 3 PRO Preview

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-04-14

Метрика	Seed-2.0-Lite Seed-2.0-Lite none Релиз: 2026-02-14	Gemini 3 PRO Preview Gemini 3 PRO Preview medium Релиз: 2025-11-18

Метрика	Seed-2.0-Lite Seed-2.0-Lite none Релиз: 2026-02-14	Gemini 3 PRO Preview Gemini 3 PRO Preview medium Релиз: 2025-11-18
Оценка	6.2	8.4
Ранг	#58	#10
Стабильность	7.7	10.0
Тестов верно
Доля успешных попыток	55.6%	77.8%
Нестабильные тесты	5	0
Всего запусков	54	54
Стоимость за результат	0.200	1.406
Общая стоимость	$0.016	$0.197
???? ?????	$0.250 / 1M	$0.000 / 1M
???? ??????	$2.000 / 1M	$0.000 / 1M
Выходные токены	3,129	1,508
Токены рассуждений	0	10,084
Время ответа (среднее)	2.53s	9.06s
Время ответа (макс.)	6.70s	26.24s
Время ответа (суммарно)	45.46s	90.58s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Seed-2.0-Lite	3.0	5.9	16.7%	2		2.43s	709	0
Gemini 3 PRO Preview	10.0	10.0	100.0%	0		14.99s	149	1,485

Программирование	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Seed-2.0-Lite	10.0	10.0	100.0%	0		4.61s	380	0
Gemini 3 PRO Preview	3.0	10.0	0.0%	0		0ms	0	0

Комбинированный	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Seed-2.0-Lite	3.0	10.0	0.0%	0		6.59s	498	0
Gemini 3 PRO Preview	3.0	10.0	0.0%	0		10.37s	351	952

Парсинг и извлечение данных	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Seed-2.0-Lite	10.0	10.0	100.0%	0		1.82s	246	0
Gemini 3 PRO Preview	10.0	10.0	100.0%	0		10.84s	279	3,156

Предметно-ориентированное	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Seed-2.0-Lite	3.6	7.2	22.2%	1		1.33s	17	0
Gemini 3 PRO Preview	5.3	10.0	33.3%	0		7.01s	15	1,195

Общий интеллект	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Seed-2.0-Lite	10.0	10.0	100.0%	0		3.45s	294	0
Gemini 3 PRO Preview	10.0	10.0	100.0%	0		9.34s	78	374

Следование инструкциям	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Seed-2.0-Lite	10.0	10.0	100.0%	0		1.06s	73	0
Gemini 3 PRO Preview	9.8	10.0	100.0%	0		3.26s	69	754

Решение головоломок	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Seed-2.0-Lite	5.2	4.4	55.6%	2		2.46s	620	0
Gemini 3 PRO Preview	10.0	10.0	100.0%	0		3.91s	243	1,197

Вызов инструментов	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Seed-2.0-Lite	10.0	10.0	100.0%	0		3.94s	292	0
Gemini 3 PRO Preview	10.0	10.0	100.0%	0		11.96s	324	971

Быстрое сравнение

Сменить пару сравнения

Seed-2.0-LitenonevsGPT-5 Nanomedium Seed-2.0-Litenonevsgpt-oss-120bmediumБесплатно доступно Seed-2.0-LitenonevsMercury 2medium Gemini 3 PRO PreviewmediumvsGPT-5.2 Chatnone Seed-2.0-LitenonevsMiniMax M2.5mediumБесплатно доступно Seed-2.0-LitenonevsGrok 4.1 Fastmedium Seed-2.0-LitenonevsMistral Small 4medium Seed-2.0-LitenonevsNemotron 3 SupermediumБесплатно доступно Gemini 3 PRO PreviewmediumvsGPT-5.3 Chatnone Seed-2.0-LitenonevsGrok 4.20medium Seed-2.0-LitenonevsKimi K2.5medium Seed-2.0-LitenonevsGPT-5 Minimedium