Навигация
AI BENCHY
Advertise here

Seed-2.0-Code (low) vs DeepSeek V4 Pro (high)

Seed-2.0-Code (low) лидирует по среднему баллу: 7.7 vs 7.7. DeepSeek V4 Pro (high) имеет более низкую стоимость benchmark: $0.537 vs $0.681. Seed-2.0-Code (low) быстрее: 65.89s vs 79.14s, с долей успешных попыток 80.3% vs 63.6%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-08-12

Ранг
#66
Общее число выходных токенов
212,558
Время ответа (среднее)
65.89s
Общая стоимость
$0.681
Ранг
#72
Общее число выходных токенов
189,181
Время ответа (среднее)
79.14s
Общая стоимость
$0.537
Рекомендуемая модель DeepSeek V4 Pro (high)

Он дает лучший общий компромисс: конкурентный балл (7.7), ниже стоимость, чем у Seed-2.0-Code (low), и сбалансированное время ответа.

Подробное сравнение

Метрика Seed-2.0-Code Seed-2.0-Code low Релиз: 2026-08-12 DeepSeek V4 Pro DeepSeek V4 Pro high Релиз: 2026-04-24
Оценка 7.7 7.7
Ранг #66 #72
Надежность 5.7 10.0
Стабильность 7.5 7.7
Попытки 66/66 66/66
Тестов верно
Доля успешных попыток 80.3% 63.6%
Нестабильные тесты 7 6
Всего запусков 66 66
Стоимость за результат 5.235 2.000
Общая стоимость $0.681 $0.537
Цена входа $0.500 / 1M $1.169 / 1M
Цена выхода $3.000 / 1M $2.337 / 1M
Общее число входных токенов 85,648 90,748
Выходные токены 8,142 10,462
Токены рассуждений 204,416 178,719
Время ответа (среднее) 65.89s 79.14s
Время ответа (макс.) 485.92s 416.76s
Время ответа (суммарно) 1449.53s 1740.97s
Параметры ~200B всего (~20B активных) 1.6T всего (49B активных)
Доступность Закрытая модель Открытый исходный код

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#66 Seed-2.0-Code

low
Provider returned error
Стоимость
$0.000
Время
0.3s
Токены
0 tok

#72 DeepSeek V4 Pro

high
Стоимость
$0.023
Время
257.6s
Токены
14,870 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Seed-2.0-Code 7.0 5.0 77.8% 2 109.70s 7,948 455 55,759
DeepSeek V4 Pro 6.3 8.7 33.3% 0 243.00s 5,090 383 84,580

Быстрое сравнение

Сменить пару сравнения