AI BENCHY Compare

Anthropic: Claude Opus 4.7 vs Qwen: Qwen3.5 Plus 2026-04-20

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-04-27

Метрика	Claude Opus 4.7 Claude Opus 4.7 none Релиз: 2026-04-16	Qwen3.5 Plus 2026-04-20 Qwen3.5 Plus 2026-04-20 medium Релиз: 2026-04-20

Метрика	Claude Opus 4.7 Claude Opus 4.7 none Релиз: 2026-04-16	Qwen3.5 Plus 2026-04-20 Qwen3.5 Plus 2026-04-20 medium Релиз: 2026-04-20
Оценка	9.2	8.1
Ранг	#4	#32
Надежность	Н/Д	9.7
Стабильность	10.0	9.0
Тестов верно
Доля успешных попыток	88.9%	77.8%
Нестабильные тесты	0	2
Всего запусков	54	54
Стоимость за результат	3.155	2.065
Общая стоимость	$0.505	$0.269
???? ?????	$5.000 / 1M	$0.400 / 1M
???? ??????	$25.000 / 1M	$2.400 / 1M
Выходные токены	6,326	2,179
Токены рассуждений	0	103,832
Время ответа (среднее)	3.13s	32.81s
Время ответа (макс.)	18.27s	92.41s
Время ответа (суммарно)	56.33s	590.65s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Claude Opus 4.7	8.3	10.0	75.0%	0		2.12s	522	0
Qwen3.5 Plus 2026-04-20	10.0	10.0	100.0%	0		10.84s	215	7,748

Программирование	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Claude Opus 4.7	10.0	10.0	100.0%	0		2.84s	494	0
Qwen3.5 Plus 2026-04-20	7.6	10.0	100.0%	0		85.72s	248	11,081

Комбинированный	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Claude Opus 4.7	9.5	10.0	100.0%	0		18.27s	3,504	0
Qwen3.5 Plus 2026-04-20	10.0	10.0	100.0%	0		92.41s	483	17,490

Парсинг и извлечение данных	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Claude Opus 4.7	10.0	10.0	100.0%	0		2.15s	324	0
Qwen3.5 Plus 2026-04-20	10.0	10.0	100.0%	0		38.32s	270	14,668

Предметно-ориентированное	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Claude Opus 4.7	7.7	10.0	66.7%	0		1.19s	78	0
Qwen3.5 Plus 2026-04-20	2.9	7.2	11.1%	1		53.10s	63	28,414

Общий интеллект	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Claude Opus 4.7	10.0	10.0	100.0%	0		3.47s	257	0
Qwen3.5 Plus 2026-04-20	4.9	9.6	0.0%	0		25.30s	125	4,792

Следование инструкциям	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Claude Opus 4.7	10.0	10.0	100.0%	0		1.46s	114	0
Qwen3.5 Plus 2026-04-20	10.0	10.0	100.0%	0		20.25s	103	7,689

Решение головоломок	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Claude Opus 4.7	10.0	10.0	100.0%	0		2.58s	661	0
Qwen3.5 Plus 2026-04-20	8.2	7.2	88.9%	1		17.58s	324	9,786

Вызов инструментов	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Claude Opus 4.7	10.0	10.0	100.0%	0		4.74s	372	0
Qwen3.5 Plus 2026-04-20	10.0	10.0	100.0%	0		14.72s	348	2,164

Быстрое сравнение

Сменить пару сравнения

Gemini 3.1 Flash Lite PreviewlowvsQwen3.5 Plus 2026-04-20medium Gemini 3 Flash PreviewnonevsQwen3.5 Plus 2026-04-20medium Qwen3.5 Plus 2026-04-20mediumvsHY3 PreviewlowБесплатно доступно Claude Opus 4.7nonevsGPT-5.5low GPT-5.2 ChatnonevsQwen3.5 Plus 2026-04-20medium Gemini 3.1 Flash Lite PreviewnonevsQwen3.5 Plus 2026-04-20medium Claude Opus 4.7nonevsGPT-5.5medium DeepSeek V4 FlashhighvsQwen3.5 Plus 2026-04-20medium Claude Opus 4.7nonevsGemini 3 Flash Previewlow Claude Opus 4.7nonevsQwen3.6 Max Previewmedium Claude Opus 4.7nonevsGemini 3.1 Pro Previewmedium Qwen3.5 Plus 2026-04-20mediumvsHY3 PreviewhighБесплатно доступно