Навигация
AI BENCHY
Advertise here

Claude Opus 5 vs Qwen: Qwen3.6 Max Preview

Claude Opus 5 (low) лидирует по среднему баллу: 8.6 vs 8.4. Claude Opus 5 (low) имеет более низкую стоимость benchmark: $1.121 vs $1.143. Claude Opus 5 (low) быстрее: 6.99s vs 67.53s, с долей успешных попыток 80.3% vs 80.3%.

Рекомендуемая модельClaude Opus 5 (low)Здесь у него лучший балл (8.6), и он отвечает примерно в 9.7 раза быстрее, чем Qwen3.6 Max Preview (medium).

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-07-25

Метрика Claude Opus 5 Claude Opus 5 low Релиз: 2026-07-25 Qwen3.6 Max Preview Qwen3.6 Max Preview medium Релиз: 2026-04-20
Оценка 8.6 8.4
Ранг #23 #25
Надежность 10.0 9.9
Стабильность 9.3 8.9
Тестов верно
Доля успешных попыток 80.3% 80.3%
Нестабильные тесты 2 3
Всего запусков 66 66
Стоимость за результат 6.593 8.173
Общая стоимость $1.121 $1.143
Цена входа $5.000 / 1M $1.040 / 1M
Цена выхода $25.000 / 1M $6.240 / 1M
Общее число входных токенов 134,773 79,240
Выходные токены 14,123 5,098
Токены рассуждений 3,896 164,842
Время ответа (среднее) 6.99s 67.53s
Время ответа (макс.) 30.67s 238.07s
Время ответа (суммарно) 153.73s 1485.64s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#23 Claude Opus 5

low
Стоимость
$0.062
Время
30.2s
Токены
2,615 tok

#25 Qwen3.6 Max Preview

medium
Стоимость
$0.024
Время
76.5s
Токены
3,861 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Claude Opus 5 7.8 7.4 77.8% 1 6.70s 10,590 2,442 760
Qwen3.6 Max Preview 8.8 7.8 88.9% 1 146.48s 7,895 427 52,957

Быстрое сравнение

Сменить пару сравнения