Навигация
Advertise here

Seed-2.0-Code (low) vs GPT-6 Luna (medium)

GPT-6 Luna (medium) лидирует по среднему баллу: 8.3 vs 8.1. GPT-6 Luna (medium) имеет более низкую стоимость benchmark: $0.047 vs $0.881. GPT-6 Luna (medium) быстрее: 18.07s vs 73.02s, с долей успешных попыток 78.3% vs 73.9%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-10-02

Сравниваемые модели

Ранг
#86
Общее число выходных токенов
253,807
Время ответа (среднее)
73.02s
Общая стоимость
$0.881
Ранг
#79
Общее число выходных токенов
53,161
Время ответа (среднее)
18.07s
Общая стоимость
$0.047
Рекомендуемая модель GPT-6 Luna (medium)

Здесь у него лучший балл (8.3), при этом он примерно в 18.8 раза дешевле, чем Seed-2.0-Code (low).

Подробное сравнение

Метрика Seed-2.0-Code Seed-2.0-Code low Релиз: 2026-08-12 GPT-6 Luna GPT-6 Luna medium Релиз: 2026-09-23
Оценка 8.1 8.3
Ранг #86 #79
Надежность 8.9 10.0
Стабильность 7.9 8.9
Попытки 69/69 69/69
Тестов верно
Доля успешных попыток 78.3% 73.9%
Нестабильные тесты 6 3
Всего запусков 69 69
Стоимость за результат 6.288 0.313
Общая стоимость $0.881 $0.047
Цена входа $0.500 / 1M $0.100 / 1M
Цена выхода $3.000 / 1M $0.500 / 1M
Цена чтения из кэша Н/Д $0.010 / 1M
Цена записи в кэш Н/Д $0.125 / 1M
Общее число входных токенов 237,604 203,193
Выходные токены 9,617 5,751
Токены рассуждений 244,190 47,410
Время ответа (среднее) 73.02s 18.07s
Время ответа (макс.) 485.92s 66.44s
Время ответа (суммарно) 1679.49s 415.53s
Параметры ~200B всего (~20B активных) ~400B всего (~17B активных)
Доступность Закрытая модель Закрытая модель

Цены кэша относятся к входным токенам. Чтение повторно использует сохранённые запросы; запись сохраняет их и может стоить дороже. Выходные токены оплачиваются по цене вывода.

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#86 Seed-2.0-Code

low
Provider returned error
Стоимость
$0.000
Время
0.3s
Токены
0 tok

#79 GPT-6 Luna

medium
Стоимость
$0.002
Время
23.6s
Токены
2,966 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Seed-2.0-Code 7.0 7.1 55.6% 1 109.70s 7,948 455 55,759
GPT-6 Luna 6.6 4.6 77.8% 2 23.63s 7,302 438 10,222

Быстрое сравнение

Сменить пару сравнения