Навигация
AI BENCHY
Advertise here

GPT-5.5 (low) vs Qwen3.5 Plus 2026-02-15 (medium)

GPT-5.5 (low) лидирует по среднему баллу: 9.3 vs 7.5. Qwen3.5 Plus 2026-02-15 (medium) имеет более низкую стоимость benchmark: $0.459 vs $1.257. GPT-5.5 (low) быстрее: 10.15s vs 91.76s, с долей успешных попыток 86.4% vs 72.7%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-08-20

Ранг
#10
Общее число выходных токенов
28,540
Время ответа (среднее)
10.15s
Общая стоимость
$1.257
Ранг
#86
Общее число выходных токенов
274,709
Время ответа (среднее)
91.76s
Общая стоимость
$0.459
Рекомендуемая модель GPT-5.5 (low)

Здесь у него лучший балл (9.3), и он отвечает примерно в 9.0 раза быстрее, чем Qwen3.5 Plus 2026-02-15 (medium).

Подробное сравнение

Метрика GPT-5.5 GPT-5.5 low Релиз: 2026-04-24 Qwen3.5 Plus 2026-02-15 Qwen3.5 Plus 2026-02-15 medium Релиз: 2026-02-15
Оценка 9.3 7.5
Ранг #10 #86
Надежность 10.0 10.0
Стабильность 10.0 8.1
Попытки 66/66 66/66
Тестов верно
Доля успешных попыток 86.4% 72.7%
Нестабильные тесты 0 5
Всего запусков 66 66
Стоимость за результат 6.614 3.483
Общая стоимость $1.257 $0.459
Цена входа $5.000 / 1M $0.260 / 1M
Цена выхода $30.000 / 1M $1.560 / 1M
Общее число входных токенов 80,067 113,569
Выходные токены 5,378 9,823
Токены рассуждений 23,162 264,886
Время ответа (среднее) 10.15s 91.76s
Время ответа (макс.) 56.19s 304.85s
Время ответа (суммарно) 223.24s 1376.42s
Параметры ~1.5T всего (~100B активных) ~397B всего (~17B активных)
Доступность Закрытая модель Закрытая модель

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#10 GPT-5.5

low
Стоимость
$0.068
Время
37.0s
Токены
2,339 tok

#86 Qwen3.5 Plus 2026-02-15

medium
Стоимость
$0.011
Время
125.5s
Токены
7,040 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
GPT-5.5 10.0 10.0 100.0% 0 15.04s 7,302 423 6,402
Qwen3.5 Plus 2026-02-15 6.6 7.1 44.4% 1 180.70s 6,950 420 80,595

Быстрое сравнение

Сменить пару сравнения