Навигация
AI BENCHY
Advertise here

AI BENCHY Compare

OpenAI: GPT-5.2 Chat vs Qwen: Qwen3.6 Max Preview

Сводка

Qwen3.6 Max Preview (medium) лидирует по среднему баллу: 8.9 vs 8.5. GPT-5.2 Chat имеет более низкую стоимость benchmark: $0.393 vs $0.960. GPT-5.2 Chat быстрее: 7.13s vs 59.63s, с долей успешных попыток 74.6% vs 81.0%.

Рекомендуемая модельGPT-5.2 ChatЕго балл близок к лучшему здесь (8.5 против 8.9), при этом он примерно в 2.4 раза дешевле, чем Qwen3.6 Max Preview (medium).

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-07-14

Метрика GPT-5.2 Chat GPT-5.2 Chat none Релиз: 2025-12-11 Qwen3.6 Max Preview Qwen3.6 Max Preview medium Релиз: 2026-04-20
Оценка 8.5 8.9
Ранг #22 #14
Надежность 10.0 10.0
Стабильность 8.9 9.3
Тестов верно
Доля успешных попыток 74.6% 81.0%
Нестабильные тесты 3 2
Всего запусков 63 63
Стоимость за результат 2.803 7.024
Общая стоимость $0.393 $0.960
Цена входа $1.750 / 1M $1.040 / 1M
Цена выхода $14.000 / 1M $6.240 / 1M
Общее число входных токенов 34,212 42,362
Выходные токены 23,744 2,273
Токены рассуждений 0 144,367
Время ответа (среднее) 7.13s 59.63s
Время ответа (макс.) 38.52s 238.07s
Время ответа (суммарно) 149.69s 1252.17s

Генерация showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#22 GPT-5.2 Chat

none
Стоимость
$0.010
Время
15.3s
Токены
797 tok

#14 Qwen3.6 Max Preview

medium
Стоимость
$0.024
Время
76.5s
Токены
3,861 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
GPT-5.2 Chat 8.8 7.8 88.9% 1 9.82s 7,305 6,731 0
Qwen3.6 Max Preview 8.8 7.8 88.9% 1 146.48s 7,895 427 52,957

Быстрое сравнение

Сменить пару сравнения