AI BENCHY Compare

ByteDance Seed: Seed-2.0-Lite vs inclusionAI: Ling-2.6-flash

Сводка

Сравнение benchmark Seed-2.0-Lite vs Ling-2.6-flash: Seed-2.0-Lite лидирует по среднему баллу: 5.8 vs 5.0. Ling-2.6-flash имеет более низкую стоимость benchmark: $0.001 vs $0.019. Seed-2.0-Lite быстрее: 2.49s vs 9.34s, с долей успешных попыток 46.0% vs 31.8%.

Рекомендуемая модель: Ling-2.6-flash - Его балл близок к лучшему здесь (5.0 против 5.8), при этом он примерно в 36.8 раза дешевле, чем Seed-2.0-Lite.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-06-04

Метрика	Seed-2.0-Lite Seed-2.0-Lite none Релиз: 2026-02-14	Ling-2.6-flash Ling-2.6-flash none Релиз: 2026-04-21

Метрика	Seed-2.0-Lite Seed-2.0-Lite none Релиз: 2026-02-14	Ling-2.6-flash Ling-2.6-flash none Релиз: 2026-04-21
Оценка	5.8	5.0
Ранг	#110	#138
Надежность	10.0	10.0
Стабильность	8.4	9.2
Тестов верно
Доля успешных попыток	46.0%	31.8%
Нестабильные тесты	4	2
Всего запусков	63	63
Стоимость за результат	0.228	0.005
Общая стоимость	$0.019	$0.001
Цена входа	$0.250 / 1M	$0.010 / 1M
Цена выхода	$2.000 / 1M	$0.030 / 1M
Общее число входных токенов	46,573	40,718
Выходные токены	3,259	2,878
Токены рассуждений	0	0
Время ответа (среднее)	2.49s	9.34s
Время ответа (макс.)	6.70s	35.34s
Время ответа (суммарно)	52.26s	177.48s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#110 Seed-2.0-Lite

none

Cost: $0.005
Time: 83.8s
Tokens: 2,311 tok

#138 Ling-2.6-flash

none

No showcase result has been generated for this model yet.

Cost: $0.000
Time: -
Tokens: 0 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Seed-2.0-Lite	3.0	5.9	16.7%	2		2.43s	894	709	0
Ling-2.6-flash	6.8	8.1	58.3%	1		11.81s	726	573	0

Программирование	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Seed-2.0-Lite	5.6	10.0	33.3%	0		2.83s	8,215	410	0
Ling-2.6-flash	5.3	10.0	33.3%	0		11.21s	813	381	0

Комбинированный	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Seed-2.0-Lite	3.0	10.0	0.0%	0		6.59s	16,215	498	0
Ling-2.6-flash	3.0	10.0	0.0%	0		35.34s	20,818	1,069	0

Парсинг и извлечение данных	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Seed-2.0-Lite	10.0	10.0	100.0%	0		1.82s	8,538	246	0
Ling-2.6-flash	6.5	10.0	50.0%	0		8.48s	8,004	246	0

Предметно-ориентированное	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Seed-2.0-Lite	3.6	7.2	22.2%	1		1.33s	939	17	0
Ling-2.6-flash	3.0	10.0	0.0%	0		4.95s	810	24	0

Общий интеллект	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Seed-2.0-Lite	10.0	10.0	100.0%	0		3.45s	570	294	0
Ling-2.6-flash	4.0	10.0	0.0%	0		1.45s	540	109	0

Следование инструкциям	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Seed-2.0-Lite	10.0	10.0	100.0%	0		1.06s	810	73	0
Ling-2.6-flash	9.8	10.0	100.0%	0		5.52s	732	81	0

Решение головоломок	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Seed-2.0-Lite	5.3	7.2	44.4%	1		2.78s	858	709	0
Ling-2.6-flash	2.9	7.2	11.1%	1		6.51s	729	151	0

Вызов инструментов	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Seed-2.0-Lite	10.0	10.0	100.0%	0		3.94s	9,270	292	0
Ling-2.6-flash	3.0	10.0	0.0%	0		18.80s	7,324	229	0

Эрудиция	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Seed-2.0-Lite	3.0	10.0	0.0%	0		1.96s	264	11	0
Ling-2.6-flash	3.0	10.0	0.0%	0		1.06s	222	15	0

Быстрое сравнение

Сменить пару сравнения

Seed-2.0-LitenonevsNemotron 3 SupermediumБесплатно доступно CobuddymediumvsSeed-2.0-Litenone Ling-2.6-flashnonevsMistral Small 4medium Ling-2.6-flashnonevsMiniMax M2.7medium Seed-2.0-LitenonevsDeepSeek V4 Prohigh Ling-2.6-flashnonevsMiniMax M2.5medium Seed-2.0-Litenonevsgpt-oss-120bmediumБесплатно доступно Ling-2.6-flashnonevsQwen3 Coder Nextmedium Seed-2.0-LitenonevsMiniMax M2.5medium Seed-2.0-LitenonevsMiniMax M2.7medium Seed-2.0-LitenonevsMistral Small 4medium Seed-2.0-LitenonevsGPT-5 Nanomedium