Навигация
Advertise here

GPT-5.6 Sol (medium) vs Qwen3.8 Max (0902) (low)

GPT-5.6 Sol (medium) лидирует по среднему баллу: 9.4 vs 9.1. GPT-5.6 Sol (medium) имеет более низкую стоимость benchmark: $0.508 vs $0.664. GPT-5.6 Sol (medium) быстрее: 12.63s vs 24.21s, с долей успешных попыток 90.9% vs 86.4%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-09-18

Сравниваемые модели

Ранг
#13
Общее число выходных токенов
34,977
Время ответа (среднее)
12.63s
Общая стоимость
$0.508
Ранг
#23
Общее число выходных токенов
75,865
Время ответа (среднее)
24.21s
Общая стоимость
$0.664
Рекомендуемая модель GPT-5.6 Sol (medium)

Здесь у него лучший балл (9.4), и он отвечает примерно в 1.9 раза быстрее, чем Qwen3.8 Max (0902) (low).

Подробное сравнение

Метрика GPT-5.6 Sol GPT-5.6 Sol medium Релиз: 2026-07-09 Qwen3.8 Max (0902) Qwen3.8 Max (0902) low Релиз: 2026-09-07
Оценка 9.4 9.1
Ранг #13 #23
Надежность 10.0 10.0
Стабильность 8.9 9.3
Попытки 66/66 66/66
Тестов верно
Доля успешных попыток 90.9% 86.4%
Нестабильные тесты 3 2
Всего запусков 66 66
Стоимость за результат 8.025 3.684
Общая стоимость $0.508 $0.664
Цена входа $2.000 / 1M $2.000 / 1M
Цена выхода $10.000 / 1M $6.000 / 1M
Общее число входных токенов 79,006 103,954
Выходные токены 4,696 6,322
Токены рассуждений 30,281 69,543
Время ответа (среднее) 12.63s 24.21s
Время ответа (макс.) 79.40s 207.79s
Время ответа (суммарно) 277.88s 532.62s
Параметры ~2T всего (~150B активных) 2.4T всего (~100B активных)
Доступность Закрытая модель Закрытая модель

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#13 GPT-5.6 Sol

medium
Стоимость
$0.124
Время
57.2s
Токены
4,199 tok

#23 Qwen3.8 Max (0902)

low
Стоимость
$0.014
Время
41.2s
Токены
2,421 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
GPT-5.6 Sol 10.0 10.0 100.0% 0 9.40s 7,302 394 4,706
Qwen3.8 Max (0902) 10.0 10.0 100.0% 0 37.42s 8,127 485 17,404

Быстрое сравнение

Сменить пару сравнения