AI BENCHY Compare

ByteDance Seed: Seed-2.0-Lite vs Laguna M.1

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-04-29

Метрика	Seed-2.0-Lite Seed-2.0-Lite none Релиз: 2026-02-14	Laguna M.1 Laguna M.1 medium Релиз: 2026-04-28 Бесплатно доступно

Метрика	Seed-2.0-Lite Seed-2.0-Lite none Релиз: 2026-02-14	Laguna M.1 Laguna M.1 medium Релиз: 2026-04-28 Бесплатно доступно
Оценка	6.2	6.3
Ранг	#79	#74
Надежность	Н/Д	10.0
Стабильность	7.7	8.6
Тестов верно
Доля успешных попыток	55.6%	53.7%
Нестабильные тесты	5	3
Всего запусков	54	54
Стоимость за результат	0.200	0.000
Общая стоимость	$0.016	$0.000
???? ?????	$0.250 / 1M	$0.000 / 1M
???? ??????	$2.000 / 1M	$0.000 / 1M
Выходные токены	3,129	63,822
Токены рассуждений	0	0
Время ответа (среднее)	2.53s	13.90s
Время ответа (макс.)	6.70s	53.14s
Время ответа (суммарно)	45.46s	250.28s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Seed-2.0-Lite	3.0	5.9	16.7%	2		2.43s	709	0
Laguna M.1	6.6	10.0	50.0%	0		9.15s	7,839	0

Программирование	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Seed-2.0-Lite	10.0	10.0	100.0%	0		4.61s	380	0
Laguna M.1	4.3	1.1	66.7%	1		35.61s	14,327	0

Комбинированный	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Seed-2.0-Lite	3.0	10.0	0.0%	0		6.59s	498	0
Laguna M.1	3.0	10.0	0.0%	0		53.14s	12,272	0

Парсинг и извлечение данных	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Seed-2.0-Lite	10.0	10.0	100.0%	0		1.82s	246	0
Laguna M.1	10.0	10.0	100.0%	0		4.93s	2,296	0

Предметно-ориентированное	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Seed-2.0-Lite	3.6	7.2	22.2%	1		1.33s	17	0
Laguna M.1	5.3	7.2	44.4%	1		24.14s	19,020	0

Общий интеллект	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Seed-2.0-Lite	10.0	10.0	100.0%	0		3.45s	294	0
Laguna M.1	4.1	10.0	0.0%	0		6.86s	1,294	0

Следование инструкциям	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Seed-2.0-Lite	10.0	10.0	100.0%	0		1.06s	73	0
Laguna M.1	10.0	10.0	100.0%	0		4.30s	1,626	0

Решение головоломок	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Seed-2.0-Lite	5.2	4.4	55.6%	2		2.46s	620	0
Laguna M.1	3.6	7.2	22.2%	1		6.97s	3,978	0

Вызов инструментов	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Seed-2.0-Lite	10.0	10.0	100.0%	0		3.94s	292	0
Laguna M.1	10.0	10.0	100.0%	0		6.31s	1,170	0

Быстрое сравнение

Сменить пару сравнения

Seed-2.0-LitenonevsLaguna Xs.2mediumБесплатно доступно Seed-2.0-LitenonevsGPT-5 Nanomedium Laguna M.1mediumБесплатно доступноvsMiMo-V2-Omninone Laguna M.1mediumБесплатно доступноvsGLM 5V Turbonone Laguna M.1mediumБесплатно доступноvsQwen3.5-Flashnone Gemma 4 26B A4BnoneБесплатно доступноvsLaguna M.1mediumБесплатно доступно Gemini 2.5 FlashnonevsLaguna M.1mediumБесплатно доступно Laguna M.1mediumБесплатно доступноvsQwen3.5-35B-A3Bnone Laguna M.1mediumБесплатно доступноvsQwen3.6 27Bnone Laguna M.1mediumБесплатно доступноvsGLM 5none Seed-2.0-Litenonevsgpt-oss-120bmediumБесплатно доступно Seed-2.0-LitenonevsMercury 2medium