Навигация
AI BENCHY
Advertise here

AI BENCHY Compare

OpenAI: GPT-5.5 vs Qwen: Qwen3.5-35B-A3B

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-05-28

Метрика GPT-5.5 GPT-5.5 none Релиз: 2026-04-24 Qwen3.5-35B-A3B Qwen3.5-35B-A3B none Релиз: 2026-02-24
Оценка 6.5 5.8
Ранг #88 #106
Надежность 10.0 10.0
Стабильность 8.7 8.9
Тестов верно
Доля успешных попыток 56.7% 45.0%
Нестабильные тесты 3 3
Всего запусков 60 60
Стоимость за результат 2.167 0.224
Общая стоимость $0.217 $0.011
Цена входа $5.000 / 1M $0.139 / 1M
Цена выхода $30.000 / 1M $1.000 / 1M
Выходные токены 1,956 4,334
Токены рассуждений 0 0
Время ответа (среднее) 1.93s 3.50s
Время ответа (макс.) 5.56s 47.43s
Время ответа (суммарно) 38.64s 70.00s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
GPT-5.5 6.9 7.9 66.7% 1 1.31s 213 0
Qwen3.5-35B-A3B 3.4 7.9 16.7% 1 1.43s 574 0
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
GPT-5.5 6.8 10.0 50.0% 0 1.52s 447 0
Qwen3.5-35B-A3B 6.8 10.0 50.0% 0 1.72s 562 0
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
GPT-5.5 3.0 10.0 0.0% 0 5.56s 300 0
Qwen3.5-35B-A3B 3.0 10.0 0.0% 0 47.43s 1,833 0
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
GPT-5.5 10.0 10.0 100.0% 0 1.18s 222 0
Qwen3.5-35B-A3B 10.0 10.0 100.0% 0 1.16s 243 0
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
GPT-5.5 2.9 7.2 11.1% 1 1.31s 52 0
Qwen3.5-35B-A3B 7.7 10.0 66.7% 0 485ms 15 0
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
GPT-5.5 10.0 10.0 100.0% 0 3.41s 124 0
Qwen3.5-35B-A3B 6.5 3.4 66.7% 1 1.19s 114 0
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
GPT-5.5 6.2 5.8 66.7% 1 1.15s 81 0
Qwen3.5-35B-A3B 6.3 10.0 50.0% 0 809ms 63 0
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
GPT-5.5 7.7 10.0 66.7% 0 1.29s 252 0
Qwen3.5-35B-A3B 3.7 7.4 22.2% 1 1.35s 655 0
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
GPT-5.5 10.0 10.0 100.0% 0 3.90s 247 0
Qwen3.5-35B-A3B 10.0 10.0 100.0% 0 2.30s 264 0
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
GPT-5.5 3.0 10.0 0.0% 0 5.01s 18 0
Qwen3.5-35B-A3B 3.0 10.0 0.0% 0 493ms 11 0

Быстрое сравнение

Сменить пару сравнения