AI BENCHY Compare

Anthropic: Claude Sonnet 4.6 vs Qwen: Qwen3.5-27B

Сводка

Сравнение benchmark Claude Sonnet 4.6 vs Qwen3.5-27B: Qwen3.5-27B лидирует по среднему баллу: 7.9 vs 7.3. Claude Sonnet 4.6 имеет более низкую стоимость benchmark: $0.316 vs $0.536. Claude Sonnet 4.6 быстрее: 5.04s vs 68.39s, с долей успешных попыток 55.6% vs 73.0%.

Рекомендуемая модель: Claude Sonnet 4.6 - Его балл близок к лучшему здесь (7.3 против 7.9), при этом он примерно в 1.7 раза дешевле, чем Qwen3.5-27B.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-06-17

Метрика	Claude Sonnet 4.6 Claude Sonnet 4.6 none Релиз: 2026-02-17	Qwen3.5-27B Qwen3.5-27B medium Релиз: 2026-02-24

Метрика	Claude Sonnet 4.6 Claude Sonnet 4.6 none Релиз: 2026-02-17	Qwen3.5-27B Qwen3.5-27B medium Релиз: 2026-02-24
Оценка	7.3	7.9
Ранг	#55	#29
Надежность	10.0	10.0
Стабильность	9.7	8.5
Тестов верно
Доля успешных попыток	55.6%	73.0%
Нестабильные тесты	1	4
Всего запусков	63	63
Стоимость за результат	2.870	4.901
Общая стоимость	$0.316	$0.536
Цена входа	$3.000 / 1M	$0.195 / 1M
Цена выхода	$15.000 / 1M	$1.560 / 1M
Общее число входных токенов	57,886	42,164
Выходные токены	9,465	8,534
Токены рассуждений	0	329,289
Время ответа (среднее)	5.04s	68.39s
Время ответа (макс.)	23.84s	234.36s
Время ответа (суммарно)	70.60s	1436.24s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#55 Claude Sonnet 4.6

none

Cost: $0.038
Time: 27.3s
Tokens: 2,598 tok

#29 Qwen3.5-27B

medium

Cost: $0.008
Time: 62.0s
Tokens: 3,099 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Claude Sonnet 4.6	4.8	10.0	25.0%	0		2.94s	636	1,214	0
Qwen3.5-27B	8.7	7.9	91.7%	1		19.75s	672	569	31,505

Программирование	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Claude Sonnet 4.6	5.5	10.0	33.3%	0		5.19s	8,522	2,127	0
Qwen3.5-27B	6.2	7.1	55.6%	1		160.69s	7,895	6,381	89,388

Комбинированный	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Claude Sonnet 4.6	9.5	10.0	100.0%	0		23.84s	26,024	3,766	0
Qwen3.5-27B	10.0	10.0	100.0%	0		163.96s	14,946	483	9,991

Парсинг и извлечение данных	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Claude Sonnet 4.6	10.0	10.0	100.0%	0		3.43s	8,574	252	0
Qwen3.5-27B	10.0	10.0	100.0%	0		30.26s	7,782	270	16,150

Предметно-ориентированное	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Claude Sonnet 4.6	7.7	10.0	66.7%	0		3.54s	759	413	0
Qwen3.5-27B	5.3	10.0	33.3%	0		79.53s	553	43	52,368

Общий интеллект	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Claude Sonnet 4.6	6.1	3.1	66.7%	1		2.56s	513	192	0
Qwen3.5-27B	6.1	3.1	66.7%	1		101.41s	524	70	23,147

Следование инструкциям	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Claude Sonnet 4.6	6.5	10.0	50.0%	0		1.96s	690	90	0
Qwen3.5-27B	10.0	10.0	100.0%	0		19.66s	699	97	11,638

Решение головоломок	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Claude Sonnet 4.6	7.7	10.0	66.7%	0		2.53s	663	533	0
Qwen3.5-27B	8.2	7.7	77.8%	1		59.60s	696	242	70,096

Вызов инструментов	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Claude Sonnet 4.6	10.0	10.0	100.0%	0		4.11s	11,301	447	0
Qwen3.5-27B	10.0	10.0	100.0%	0		7.45s	8,193	348	1,323

Эрудиция	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Claude Sonnet 4.6	3.0	10.0	0.0%	0		4.67s	204	431	0
Qwen3.5-27B	3.0	10.0	0.0%	0		85.11s	204	31	23,683

Быстрое сравнение

Сменить пару сравнения