Навигация
AI BENCHY
Advertise here

AI BENCHY Compare

ByteDance Seed: Seed-2.0-Mini vs DeepSeek: DeepSeek V4 Pro

Сводка

Сравнение benchmark Seed-2.0-Mini vs DeepSeek V4 Pro: Seed-2.0-Mini лидирует по среднему баллу: 7.4 vs 7.2. DeepSeek V4 Pro имеет более низкую стоимость benchmark: $0.034 vs $0.044. DeepSeek V4 Pro быстрее: 6.41s vs 80.22s, с долей успешных попыток 57.1% vs 52.4%.

Рекомендуемая модель: DeepSeek V4 Pro - Его балл близок к лучшему здесь (7.2 против 7.4), и он отвечает примерно в 12.5 раза быстрее, чем Seed-2.0-Mini.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-06-18

Метрика Seed-2.0-Mini Seed-2.0-Mini medium Релиз: 2026-02-14 DeepSeek V4 Pro DeepSeek V4 Pro none Релиз: 2026-04-24
Оценка 7.4 7.2
Ранг #50 #58
Надежность 6.7 9.9
Стабильность 9.3 8.8
Тестов верно
Доля успешных попыток 57.1% 52.4%
Нестабильные тесты 2 3
Всего запусков 63 63
Стоимость за результат 0.397 0.333
Общая стоимость $0.044 $0.034
Цена входа $0.100 / 1M $0.435 / 1M
Цена выхода $0.400 / 1M $0.870 / 1M
Общее число входных токенов 41,904 53,558
Выходные токены 2,555 11,424
Токены рассуждений 95,974 0
Время ответа (среднее) 80.22s 6.41s
Время ответа (макс.) 262.83s 30.09s
Время ответа (суммарно) 1363.72s 134.66s

Генерация showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#50 Seed-2.0-Mini

medium
Стоимость
$0.002
Время
161.7s
Токены
4,379 tok

#58 DeepSeek V4 Pro

none
Неверный SVG
Стоимость
$0.000
Время
300.0s
Токены
0 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Seed-2.0-Mini 6.6 10.0 50.0% 0 74.75s 791 360 9,520
DeepSeek V4 Pro 3.2 6.1 16.7% 2 4.02s 540 1,168 0
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Seed-2.0-Mini 5.5 9.8 33.3% 0 220.48s 3,823 464 34,964
DeepSeek V4 Pro 5.6 10.0 33.3% 0 13.38s 7,275 5,500 0
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Seed-2.0-Mini 10.0 10.0 100.0% 0 262.83s 16,533 404 29,806
DeepSeek V4 Pro 9.5 10.0 100.0% 0 23.74s 27,529 2,235 0
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Seed-2.0-Mini 10.0 10.0 100.0% 0 24.27s 8,568 246 2,743
DeepSeek V4 Pro 10.0 10.0 100.0% 0 4.61s 7,568 200 0
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Seed-2.0-Mini 3.0 10.0 0.0% 0 0ms 0 0 0
DeepSeek V4 Pro 5.3 10.0 33.3% 0 3.72s 666 24 0
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Seed-2.0-Mini 5.1 3.4 33.3% 1 36.65s 585 213 4,210
DeepSeek V4 Pro 5.0 10.0 0.0% 0 2.05s 471 126 0
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Seed-2.0-Mini 10.0 10.0 100.0% 0 17.47s 840 69 2,050
DeepSeek V4 Pro 6.3 5.8 66.7% 1 4.12s 627 713 0
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Seed-2.0-Mini 8.2 7.2 88.9% 1 31.79s 903 527 5,667
DeepSeek V4 Pro 10.0 10.0 100.0% 0 3.61s 594 442 0
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Seed-2.0-Mini 10.0 10.0 100.0% 0 88.68s 9,585 222 5,235
DeepSeek V4 Pro 10.0 10.0 100.0% 0 7.40s 8,105 328 0
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Seed-2.0-Mini 3.0 10.0 0.0% 0 56.76s 276 50 1,779
DeepSeek V4 Pro 3.0 10.0 0.0% 0 5.76s 183 688 0

Быстрое сравнение

Сменить пару сравнения