- Ранг
- #20
- Общее число выходных токенов
- 21,004
- Время ответа (среднее)
- 23.72s
- Общая стоимость
- $0.952
Claude Opus 5.5 (low) vs Qwen3.7 Max (medium)
Claude Opus 5.5 (low) лидирует по среднему баллу: 9.3 vs 9.1. Claude Opus 5.5 (low) имеет более низкую стоимость benchmark: $0.952 vs $1.157. Claude Opus 5.5 (low) быстрее: 23.72s vs 44.32s, с долей успешных попыток 87.9% vs 86.4%.
Сравниваемые модели
- Ранг
- #29
- Общее число выходных токенов
- 226,102
- Время ответа (среднее)
- 44.32s
- Общая стоимость
- $1.157
Рекомендуемая модель
Claude Opus 5.5 (low)
Здесь у него лучший балл (9.3), и он отвечает примерно в 1.9 раза быстрее, чем Qwen3.7 Max (medium).
Подробное сравнение
| Метрика | Claude Opus 5.5 Claude Opus 5.5 low | Qwen3.7 Max Qwen3.7 Max medium |
|---|---|---|
| Оценка | 9.3 | 9.1 |
| Ранг | #20 | #29 |
| Надежность | 10.0 | 10.0 |
| Стабильность | 9.3 | 9.0 |
| Попытки | 66/66 | 66/66 |
| Тестов верно | ||
| Доля успешных попыток | 87.9% | 86.4% |
| Нестабильные тесты | 2 | 3 |
| Всего запусков | 66 | 66 |
| Стоимость за результат | 5.284 | 8.904 |
| Общая стоимость | $0.952 | $1.157 |
| Цена входа | $4.000 / 1M | $1.475 / 1M |
| Цена выхода | $20.000 / 1M | $4.425 / 1M |
| Общее число входных токенов | 132,746 | 106,029 |
| Выходные токены | 6,454 | 5,748 |
| Токены рассуждений | 14,550 | 220,354 |
| Время ответа (среднее) | 23.72s | 44.32s |
| Время ответа (макс.) | 89.16s | 556.06s |
| Время ответа (суммарно) | 521.82s | 975.11s |
| Параметры | ~5T всего (~500B активных) | ~1T всего (~40B активных) |
| Доступность | Закрытая модель | Закрытая модель |
Генерация showcase моделей
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#20 Claude Opus 5.5
low
Неверный SVG
- Стоимость
- $0.038
- Время
- 19.1s
- Токены
- 2,010 tok
#29 Qwen3.7 Max
medium- Стоимость
- $0.017
- Время
- 68.8s
- Токены
- 4,526 tok
Лучшие модели по оценке
Оценка vs общая стоимость
Время ответа (среднее)
Оценка vs Время ответа (среднее)
Общее число выходных токенов
Оценка vs Общее число выходных токенов
Разбивка по категориям
| Анти-ИИ уловки | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5 | 10.0 | 10.0 | 100.0% | 0 | 11.92s | 858 | 266 | 473 | |
| Qwen3.7 Max | 10.0 | 10.0 | 100.0% | 0 | 6.36s | 672 | 222 | 8,742 |
| Программирование | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5 | 10.0 | 10.0 | 100.0% | 0 | 12.23s | 10,608 | 575 | 2,777 | |
| Qwen3.7 Max | 10.0 | 10.0 | 100.0% | 0 | 35.31s | 7,893 | 423 | 34,808 |
| Комбинированный | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5 | 10.0 | 10.0 | 100.0% | 0 | 53.65s | 95,471 | 3,968 | 2,689 | |
| Qwen3.7 Max | 8.7 | 6.9 | 83.3% | 1 | 287.83s | 78,594 | 3,985 | 96,450 |
| Парсинг и извлечение данных | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5 | 10.0 | 10.0 | 100.0% | 0 | 12.01s | 10,515 | 312 | 234 | |
| Qwen3.7 Max | 10.0 | 10.0 | 100.0% | 0 | 8.80s | 7,782 | 270 | 6,254 |
| Предметно-ориентированное | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5 | 5.9 | 7.2 | 55.6% | 1 | 22.78s | 990 | 59 | 7,428 | |
| Qwen3.7 Max | 4.1 | 4.4 | 44.5% | 2 | 52.45s | 780 | 61 | 41,143 |
| Общий интеллект | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5 | 10.0 | 10.0 | 100.0% | 0 | 5.68s | 714 | 292 | 326 | |
| Qwen3.7 Max | 10.0 | 10.0 | 100.0% | 0 | 11.70s | 516 | 135 | 4,457 |
| Следование инструкциям | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5 | 10.0 | 10.0 | 100.0% | 0 | 21.06s | 921 | 96 | 226 | |
| Qwen3.7 Max | 10.0 | 10.0 | 100.0% | 0 | 7.46s | 699 | 102 | 5,452 |
| Решение головоломок | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5 | 8.7 | 7.7 | 88.9% | 1 | 29.83s | 912 | 448 | 397 | |
| Qwen3.7 Max | 10.0 | 10.0 | 100.0% | 0 | 8.84s | 696 | 259 | 8,908 |
| Вызов инструментов | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5 | 10.0 | 10.0 | 100.0% | 0 | 72.62s | 11,757 | 438 | 0 | |
| Qwen3.7 Max | 10.0 | 10.0 | 100.0% | 0 | 6.63s | 8,193 | 267 | 1,220 |
| Эрудиция | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5 | 3.0 | 10.0 | 0.0% | 0 | 27.89s | 0 | 0 | 0 | |
| Qwen3.7 Max | 3.0 | 10.0 | 0.0% | 0 | 33.37s | 204 | 24 | 12,920 |
Быстрое сравнение
Сменить пару сравнения
Claude Opus 5.5lowvsGrok 4.6highClaude Fable 5.1highvsQwen3.7 MaxmediumSeed 2.1 TurbolowvsQwen3.7 MaxmediumClaude Opus 5.5lowvsGemini 3.1 Pro PreviewmediumClaude Opus 5.5lowvsGPT-5.6 SolhighClaude Opus 5.5lowvsGPT-6 AstramediumClaude Opus 5.5lowvsGPT-5.6 SolmediumClaude Opus 5.5lowvsGPT-6 SolmediumQwen3.7 MaxmediumvsGrok 4.5highClaude Opus 5.5lowvsGemini 3.7 FlashmediumClaude Opus 5.5lowvsGemini 3.5 FlashhighMuse Spark 1.3highvsQwen3.7 Maxmedium