Навигация
Advertise here

Seed-2.0-Code (medium) vs GPT-5.6 Luna (medium)

Средний балл практически равен: 7.4 vs 7.4. GPT-5.6 Luna (medium) имеет более низкую стоимость benchmark: $0.065 vs $1.275. GPT-5.6 Luna (medium) быстрее: 9.64s vs 100.65s, с долей успешных попыток 65.2% vs 62.3%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-10-07

Сравниваемые модели

Ранг
#135
Общее число выходных токенов
384,093
Время ответа (среднее)
100.65s
Общая стоимость
$1.275
Ранг
#132
Общее число выходных токенов
47,986
Время ответа (среднее)
9.64s
Общая стоимость
$0.065
Рекомендуемая модель GPT-5.6 Luna (medium)

Здесь у него лучший балл (7.4), при этом он примерно в 19.8 раза дешевле, чем Seed-2.0-Code (medium).

Подробное сравнение

Метрика Seed-2.0-Code Seed-2.0-Code medium Релиз: 2026-08-12 GPT-5.6 Luna GPT-5.6 Luna medium Релиз: 2026-07-09
Оценка 7.4 7.4
Ранг #135 #132
Надежность 8.0 10.0
Стабильность 7.4 9.0
Попытки 69/69 69/69
Тестов верно
Доля успешных попыток 65.2% 62.3%
Нестабильные тесты 7 3
Всего запусков 69 69
Стоимость за результат 11.587 2.822
Общая стоимость $1.275 $0.065
Цена входа $0.500 / 1M $0.200 / 1M
Цена выхода $3.000 / 1M $1.200 / 1M
Цена чтения из кэша Н/Д $0.020 / 1M
Цена записи в кэш Н/Д $0.250 / 1M
Общее число входных токенов 244,499 212,780
Выходные токены 8,744 6,849
Токены рассуждений 375,349 41,137
Время ответа (среднее) 100.65s 9.64s
Время ответа (макс.) 626.58s 58.09s
Время ответа (суммарно) 2314.88s 221.62s
Параметры ~200B всего (~20B активных) ~400B всего (~17B активных)
Доступность Закрытая модель Закрытая модель

Цены кэша относятся к входным токенам. Чтение повторно использует сохранённые запросы; запись сохраняет их и может стоить дороже. Выходные токены оплачиваются по цене вывода.

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#135 Seed-2.0-Code

medium
Стоимость
$0.026
Время
122.8s
Токены
8,630 tok

#132 GPT-5.6 Luna

medium
Стоимость
$0.014
Время
14.6s
Токены
2,362 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Seed-2.0-Code 8.9 7.8 88.9% 1 89.94s 8,247 496 44,062
GPT-5.6 Luna 5.4 7.2 44.4% 1 10.38s 7,302 564 9,928

Сменить пару сравнения