Навигация
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Anthropic: Claude Opus 4.7 vs Qwen: Qwen3.6 Max Preview

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-04-27

Метрика Claude Opus 4.7 Claude Opus 4.7 none Релиз: 2026-04-16 Qwen3.6 Max Preview Qwen3.6 Max Preview medium Релиз: 2026-04-20
Оценка 9.2 8.8
Ранг #4 #8
Надежность Н/Д 10.0
Стабильность 10.0 9.5
Тестов верно
Доля успешных попыток 88.9% 85.2%
Нестабильные тесты 0 1
Всего запусков 54 54
Стоимость за результат 3.155 5.486
Общая стоимость $0.505 $0.823
???? ????? $5.000 / 1M $1.300 / 1M
???? ?????? $25.000 / 1M $7.800 / 1M
Выходные токены 6,326 2,158
Токены рассуждений 0 97,495
Время ответа (среднее) 3.13s 48.31s
Время ответа (макс.) 18.27s 186.74s
Время ответа (суммарно) 56.33s 869.64s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Opus 4.7 8.3 10.0 75.0% 0 2.12s 522 0
Qwen3.6 Max Preview 10.0 10.0 100.0% 0 22.13s 228 10,075
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Opus 4.7 10.0 10.0 100.0% 0 2.84s 494 0
Qwen3.6 Max Preview 10.0 10.0 100.0% 0 117.87s 368 13,790
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Opus 4.7 9.5 10.0 100.0% 0 18.27s 3,504 0
Qwen3.6 Max Preview 10.0 10.0 100.0% 0 121.49s 390 14,575
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Opus 4.7 10.0 10.0 100.0% 0 2.15s 324 0
Qwen3.6 Max Preview 10.0 10.0 100.0% 0 41.15s 270 10,106
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Opus 4.7 7.7 10.0 66.7% 0 1.19s 78 0
Qwen3.6 Max Preview 2.9 7.2 11.1% 1 95.91s 60 30,371
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Opus 4.7 10.0 10.0 100.0% 0 3.47s 257 0
Qwen3.6 Max Preview 10.0 10.0 100.0% 0 32.24s 129 3,510
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Opus 4.7 10.0 10.0 100.0% 0 1.46s 114 0
Qwen3.6 Max Preview 10.0 10.0 100.0% 0 24.31s 103 5,848
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Opus 4.7 10.0 10.0 100.0% 0 2.58s 661 0
Qwen3.6 Max Preview 10.0 10.0 100.0% 0 24.19s 301 7,649
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Opus 4.7 10.0 10.0 100.0% 0 4.74s 372 0
Qwen3.6 Max Preview 10.0 10.0 100.0% 0 18.32s 309 1,571

Быстрое сравнение

Сменить пару сравнения