AI BENCHY Compare

ByteDance Seed: Seed-2.0-Lite vs Google: Gemini 3.1 Pro Preview

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-04-26

Метрика	Seed-2.0-Lite Seed-2.0-Lite none Релиз: 2026-02-14	Gemini 3.1 Pro Preview Gemini 3.1 Pro Preview medium Релиз: 2026-02-19

Метрика	Seed-2.0-Lite Seed-2.0-Lite none Релиз: 2026-02-14	Gemini 3.1 Pro Preview Gemini 3.1 Pro Preview medium Релиз: 2026-02-19
Оценка	6.2	9.6
Ранг	#72	#2
Надежность	Н/Д	Н/Д
Стабильность	7.7	10.0
Тестов верно
Доля успешных попыток	55.6%	94.4%
Нестабильные тесты	5	0
Всего запусков	54	54
Стоимость за результат	0.200	3.400
Общая стоимость	$0.016	$0.578
???? ?????	$0.250 / 1M	$2.000 / 1M
???? ??????	$2.000 / 1M	$12.000 / 1M
Выходные токены	3,129	1,932
Токены рассуждений	0	40,542
Время ответа (среднее)	2.53s	15.96s
Время ответа (макс.)	6.70s	40.61s
Время ответа (суммарно)	45.46s	175.52s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Seed-2.0-Lite	3.0	5.9	16.7%	2		2.43s	709	0
Gemini 3.1 Pro Preview	10.0	10.0	100.0%	0		7.90s	112	3,218

Программирование	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Seed-2.0-Lite	10.0	10.0	100.0%	0		4.61s	380	0
Gemini 3.1 Pro Preview	10.0	10.0	100.0%	0		19.88s	405	4,201

Комбинированный	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Seed-2.0-Lite	3.0	10.0	0.0%	0		6.59s	498	0
Gemini 3.1 Pro Preview	9.5	10.0	100.0%	0		40.61s	432	9,281

Парсинг и извлечение данных	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Seed-2.0-Lite	10.0	10.0	100.0%	0		1.82s	246	0
Gemini 3.1 Pro Preview	10.0	10.0	100.0%	0		7.72s	279	3,904

Предметно-ориентированное	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Seed-2.0-Lite	3.6	7.2	22.2%	1		1.33s	17	0
Gemini 3.1 Pro Preview	7.7	10.0	66.7%	0		32.73s	18	12,424

Общий интеллект	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Seed-2.0-Lite	10.0	10.0	100.0%	0		3.45s	294	0
Gemini 3.1 Pro Preview	10.0	10.0	100.0%	0		11.77s	108	1,179

Следование инструкциям	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Seed-2.0-Lite	10.0	10.0	100.0%	0		1.06s	73	0
Gemini 3.1 Pro Preview	10.0	10.0	100.0%	0		9.56s	72	2,236

Решение головоломок	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Seed-2.0-Lite	5.2	4.4	55.6%	2		2.46s	620	0
Gemini 3.1 Pro Preview	10.0	10.0	100.0%	0		7.15s	232	3,117

Вызов инструментов	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Seed-2.0-Lite	10.0	10.0	100.0%	0		3.94s	292	0
Gemini 3.1 Pro Preview	10.0	10.0	100.0%	0		23.15s	274	982

Быстрое сравнение

Сменить пару сравнения

Seed-2.0-LitenonevsGPT-5 Nanomedium Seed-2.0-Litenonevsgpt-oss-120bmediumБесплатно доступно Seed-2.0-LitenonevsMercury 2medium Claude Opus 4.7nonevsGemini 3.1 Pro Previewmedium Seed-2.0-LitenonevsMiniMax M2.5mediumБесплатно доступно Seed-2.0-LitenonevsGrok 4.1 Fastmedium Seed-2.0-LitenonevsMistral Small 4medium Gemini 3.1 Pro PreviewmediumvsGPT-5.5low Seed-2.0-LitenonevsNemotron 3 SupermediumБесплатно доступно Seed-2.0-LitenonevsDeepSeek V4 Prohigh Seed-2.0-LitenonevsGrok 4.20medium Seed-2.0-LitenonevsKimi K2.5medium