Навигация
Advertise here

Seed-2.0-Code (high) vs GPT-5.6 Luna (medium)

Seed-2.0-Code (high) лидирует по среднему баллу: 7.5 vs 7.4. GPT-5.6 Luna (medium) имеет более низкую стоимость benchmark: $0.101 vs $1.448. GPT-5.6 Luna (medium) быстрее: 9.64s vs 124.87s, с долей успешных попыток 65.2% vs 62.3%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-10-01

Сравниваемые модели

Ранг
#121
Общее число выходных токенов
432,850
Время ответа (среднее)
124.87s
Общая стоимость
$1.448
Ранг
#122
Общее число выходных токенов
47,986
Время ответа (среднее)
9.64s
Общая стоимость
$0.101
Рекомендуемая модель GPT-5.6 Luna (medium)

Его балл близок к лучшему здесь (7.4 против 7.5), при этом он примерно в 14.5 раза дешевле, чем Seed-2.0-Code (high).

Подробное сравнение

Метрика Seed-2.0-Code Seed-2.0-Code high Релиз: 2026-08-12 GPT-5.6 Luna GPT-5.6 Luna medium Релиз: 2026-07-09
Оценка 7.5 7.4
Ранг #121 #122
Надежность 9.0 10.0
Стабильность 7.9 9.0
Попытки 69/69 69/69
Тестов верно
Доля успешных попыток 65.2% 62.3%
Нестабильные тесты 5 3
Всего запусков 69 69
Стоимость за результат 12.061 2.822
Общая стоимость $1.448 $0.101
Цена входа $0.500 / 1M $0.200 / 1M
Цена выхода $3.000 / 1M $1.200 / 1M
Общее число входных токенов 297,321 212,780
Выходные токены 8,997 6,849
Токены рассуждений 423,853 41,137
Время ответа (среднее) 124.87s 9.64s
Время ответа (макс.) 675.30s 58.09s
Время ответа (суммарно) 2871.96s 221.62s
Параметры ~200B всего (~20B активных) ~400B всего (~17B активных)
Доступность Закрытая модель Закрытая модель

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#121 Seed-2.0-Code

high
Стоимость
$0.037
Время
183.6s
Токены
12,388 tok

#122 GPT-5.6 Luna

medium
Стоимость
$0.014
Время
14.6s
Токены
2,362 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Seed-2.0-Code 6.2 6.5 55.6% 1 266.74s 6,750 432 124,956
GPT-5.6 Luna 5.4 7.2 44.4% 1 10.38s 7,302 564 9,928

Быстрое сравнение

Сменить пару сравнения