Навигация
Advertise here

GPT-5.2 Chat vs Qwen3.8 Flash Next (xhigh)

Qwen3.8 Flash Next (xhigh) лидирует по среднему баллу: 7.1 vs 7.0. Qwen3.8 Flash Next (xhigh) имеет более низкую стоимость benchmark: ~$0.195 vs $0.594. GPT-5.2 Chat быстрее: 7.43s vs 102.66s, с долей успешных попыток 66.7% vs 72.5%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-10-05

Сравниваемые модели

Ранг
#158
Общее число выходных токенов
29,742
Время ответа (среднее)
7.43s
Общая стоимость
$0.594
Ранг
#154
Общее число выходных токенов
621,056
Время ответа (среднее)
102.66s
Общая стоимость
~$0.195
Рекомендуемая модель GPT-5.2 Chat

Его балл близок к лучшему здесь (7.0 против 7.1), и он отвечает примерно в 13.8 раза быстрее, чем Qwen3.8 Flash Next (xhigh).

Подробное сравнение

Метрика GPT-5.2 Chat GPT-5.2 Chat none Релиз: 2025-12-11 Qwen3.8 Flash Next Qwen3.8 Flash Next xhigh Релиз: 2026-10-04
Оценка 7.0 7.1
Ранг #158 #154
Надежность 10.0 9.9
Стабильность 8.7 7.9
Попытки 69/69 69/69
Тестов верно
Доля успешных попыток 66.7% 72.5%
Нестабильные тесты 4 6
Всего запусков 69 69
Стоимость за результат 4.564 ~1.390
Общая стоимость $0.594 ~$0.195
Цена входа $1.750 / 1M Н/Д
Цена выхода $14.000 / 1M Н/Д
Цена чтения из кэша $0.175 / 1M Н/Д
Цена записи в кэш Н/Д Н/Д
Общее число входных токенов 101,104 301,749
Выходные токены 29,742 1,033
Токены рассуждений 0 620,023
Время ответа (среднее) 7.43s 102.66s
Время ответа (макс.) 38.52s 674.08s
Время ответа (суммарно) 163.35s 2361.10s
Параметры ~400B всего (~17B активных) 180B всего (6B активных)
Доступность Закрытая модель Веса доступны

Цены кэша относятся к входным токенам. Чтение повторно использует сохранённые запросы; запись сохраняет их и может стоить дороже. Выходные токены оплачиваются по цене вывода.

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#158 GPT-5.2 Chat

none
Стоимость
$0.010
Время
15.3s
Токены
797 tok

#154 Qwen3.8 Flash Next

xhigh
Стоимость
~$0.010
Время
333.1s
Токены
30,654 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
GPT-5.2 Chat 8.8 7.8 88.9% 1 9.82s 7,305 6,731 0
Qwen3.8 Flash Next 7.4 7.0 77.8% 1 192.20s 8,235 122 186,070

Быстрое сравнение

Сменить пару сравнения

Gemini 3.1 Flash Lite PreviewmediumvsGPT-5.2 ChatnoneKimi K2.7 CodemediumvsGPT-5.2 ChatnoneQwen3.8 Flash NextxhighvsGLM 5.3 FlashXmediumGPT-5.2 ChatnonevsMiMo-V2.5mediumQwen3.8 Flash NextxhighvsMiMo-V2.6-FlashlowEmber-1lowvsGPT-5.2 ChatnoneClaude Opus 5nonevsQwen3.8 Flash NextxhighGPT-5.2 ChatnonevsMiMo-V2.6-FlashlowQwen3.8 Flash NextxhighvsMiMo-V2.5mediumGPT-5.2 ChatnonevsGLM 5.3 FlashXmediumQwen3.8 Flash NextxhighvsStep 3.7 FlashlowGPT-5.2 ChatnonevsQwen3.5-122B-A10Bmedium