Навигация
AI BENCHY
Advertise here

Seed-2.0-Code (high) vs DeepSeek V3.2 (medium)

DeepSeek V3.2 (medium) лидирует по среднему баллу: 7.0 vs 6.9. DeepSeek V3.2 (medium) имеет более низкую стоимость benchmark: $0.078 vs $1.273. DeepSeek V3.2 (medium) быстрее: 68.43s vs 124.18s, с долей успешных попыток 63.6% vs 65.2%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-08-15

Ранг
#125
Общее число выходных токенов
410,575
Время ответа (среднее)
124.18s
Общая стоимость
$1.273
Ранг
#116
Общее число выходных токенов
128,787
Время ответа (среднее)
68.43s
Общая стоимость
$0.078
Рекомендуемая модель DeepSeek V3.2 (medium)

Здесь у него лучший балл (7.0), при этом он примерно в 16.5 раза дешевле, чем Seed-2.0-Code (high).

Подробное сравнение

Метрика Seed-2.0-Code Seed-2.0-Code high Релиз: 2026-08-12 DeepSeek V3.2 DeepSeek V3.2 medium Релиз: 2025-12-01
Оценка 6.9 7.0
Ранг #125 #116
Надежность 8.6 10.0
Стабильность 7.8 7.4
Попытки 66/66 66/66
Тестов верно
Доля успешных попыток 63.6% 65.2%
Нестабильные тесты 5 7
Всего запусков 66 66
Стоимость за результат 11.571 0.672
Общая стоимость $1.273 $0.078
Цена входа $0.500 / 1M $0.269 / 1M
Цена выхода $3.000 / 1M $0.400 / 1M
Общее число входных токенов 81,970 101,056
Выходные токены 7,186 11,832
Токены рассуждений 403,389 116,955
Время ответа (среднее) 124.18s 68.43s
Время ответа (макс.) 675.30s 376.10s
Время ответа (суммарно) 2732.03s 1505.53s
Параметры ~200B всего (~20B активных) 671B всего (37B активных)
Доступность Закрытая модель Открытый исходный код

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#125 Seed-2.0-Code

high
Стоимость
$0.037
Время
183.6s
Токены
12,388 tok

#116 DeepSeek V3.2

medium
Стоимость
$0.001
Время
53.6s
Токены
1,932 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Seed-2.0-Code 6.2 6.5 55.6% 1 266.74s 6,750 432 124,956
DeepSeek V3.2 6.0 7.2 55.6% 1 248.68s 5,717 649 52,014

Быстрое сравнение

Сменить пару сравнения