Навигация
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

ByteDance Seed: Seed-2.0-Lite vs DeepSeek: DeepSeek V3.2

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-03-15

Метрика Seed-2.0-Lite Seed-2.0-Lite medium Релиз: 2026-02-14 DeepSeek V3.2 DeepSeek V3.2 medium Релиз: 2025-12-01
Ранг #3 #14
Оценка 8.8 8.1
Стабильность 8.7 8.5
Стоимость за результат 0.870 0.225
Общая стоимость $0.105 $0.025
Тестов верно
Доля успешных попыток 87.5% 79.2%
Нестабильные тесты 3 3
Всего запусков 48 48
Выходные токены 2,815 7,392
Токены рассуждений 44,618 39,089
Время ответа (среднее) 29.39s 39.48s
Время ответа (макс.) 168.71s 93.11s
Время ответа (суммарно) 470.29s 631.71s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Seed-2.0-Lite 10.0 10.0 100.0% 0 23.34s 990 7,037
DeepSeek V3.2 7.8 9.9 66.7% 0 33.39s 1,171 4,893
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Seed-2.0-Lite 10.0 10.0 100.0% 0 37.67s 506 4,299
DeepSeek V3.2 10.0 10.0 100.0% 0 93.11s 571 6,296
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Seed-2.0-Lite 10.0 10.0 100.0% 0 9.07s 246 1,742
DeepSeek V3.2 10.0 10.0 100.0% 0 36.09s 207 7,693
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Seed-2.0-Lite 5.9 7.2 55.6% 1 88.74s 15 23,897
DeepSeek V3.2 5.3 7.2 44.4% 1 39.32s 3,081 7,856
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Seed-2.0-Lite 6.7 3.6 66.7% 1 18.25s 304 1,620
DeepSeek V3.2 5.4 2.5 66.7% 1 31.30s 68 2,366
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Seed-2.0-Lite 10.0 10.0 100.0% 0 7.26s 71 1,480
DeepSeek V3.2 10.0 10.0 100.0% 0 35.78s 1,397 2,845
Puzzle Solving Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Seed-2.0-Lite 9.0 7.9 88.9% 1 11.03s 461 3,532
DeepSeek V3.2 8.2 7.2 88.9% 1 36.87s 390 6,281
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Seed-2.0-Lite 10.0 10.0 100.0% 0 12.38s 222 1,011
DeepSeek V3.2 10.0 10.0 100.0% 0 34.81s 507 859

Быстрое сравнение

Сменить пару сравнения