Навигация
Advertise here

GPT-5.2 (medium) vs Qwen3.8 MAX (low)

Qwen3.8 MAX (low) лидирует по среднему баллу: 8.8 vs 8.7. Qwen3.8 MAX (low) имеет более низкую стоимость benchmark: $1.089 vs $1.558. Qwen3.8 MAX (low) быстрее: 25.09s vs 31.29s, с долей успешных попыток 73.9% vs 81.2%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-10-02

Сравниваемые модели

Ранг
#54
Общее число выходных токенов
80,538
Время ответа (среднее)
31.29s
Общая стоимость
$1.558
Ранг
#49
Общее число выходных токенов
93,936
Время ответа (среднее)
25.09s
Общая стоимость
$1.089
Рекомендуемая модель Qwen3.8 MAX (low)

У него самый высокий балл в этом сравнении (8.8) и лучший общий баланс стоимости и времени ответа среди всех 2 моделей.

Подробное сравнение

Метрика GPT-5.2 GPT-5.2 medium Релиз: 2025-12-11 Qwen3.8 MAX Qwen3.8 MAX low Релиз: 2026-08-04
Оценка 8.7 8.8
Ранг #54 #49
Надежность 10.0 10.0
Стабильность 8.5 9.0
Попытки 69/69 69/69
Тестов верно
Доля успешных попыток 73.9% 81.2%
Нестабильные тесты 4 3
Всего запусков 69 69
Стоимость за результат 10.261 5.051
Общая стоимость $1.558 $1.089
Цена входа $1.750 / 1M $2.000 / 1M
Цена выхода $14.000 / 1M $6.000 / 1M
Цена чтения из кэша $0.175 / 1M Н/Д
Цена записи в кэш Н/Д Н/Д
Общее число входных токенов 235,207 262,495
Выходные токены 11,065 7,787
Токены рассуждений 69,473 86,149
Время ответа (среднее) 31.29s 25.09s
Время ответа (макс.) 116.86s 155.75s
Время ответа (суммарно) 531.98s 577.14s
Параметры ~1.2T всего (~80B активных) 2.4T всего (~100B активных)
Доступность Закрытая модель Закрытая модель

Цены кэша относятся к входным токенам. Чтение повторно использует сохранённые запросы; запись сохраняет их и может стоить дороже. Выходные токены оплачиваются по цене вывода.

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#54 GPT-5.2

medium
Стоимость
$0.047
Время
49.2s
Токены
3,396 tok

#49 Qwen3.8 MAX

low
Стоимость
$0.026
Время
68.5s
Токены
4,280 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
GPT-5.2 10.0 10.0 100.0% 0 22.73s 7,302 511 11,912
Qwen3.8 MAX 8.4 7.4 88.9% 1 28.69s 8,127 512 15,952

Быстрое сравнение

Сменить пару сравнения