- Ранг
- #160
- Общее число выходных токенов
- 386,642
- Время ответа (среднее)
- 153.29s
- Общая стоимость
- $0.492
LongCat 2.0 (high) vs Qwen3.6 35B A3B (medium)
LongCat 2.0 (high) лидирует по среднему баллу: 6.7 vs 6.6. LongCat 2.0 (high) имеет более низкую стоимость benchmark: $0.492 vs $0.672. Qwen3.6 35B A3B (medium) быстрее: 58.49s vs 153.29s, с долей успешных попыток 51.5% vs 57.6%.
- Ранг
- #167
- Общее число выходных токенов
- 743,292
- Время ответа (среднее)
- 58.49s
- Общая стоимость
- $0.672
Рекомендуемая модель
Qwen3.6 35B A3B (medium)
Его балл близок к лучшему здесь (6.6 против 6.7), и он отвечает примерно в 2.6 раза быстрее, чем LongCat 2.0 (high).
Подробное сравнение
| Метрика | LongCat 2.0 LongCat 2.0 high | Qwen3.6 35B A3B Qwen3.6 35B A3B medium |
|---|---|---|
| Оценка | 6.7 | 6.6 |
| Ранг | #160 | #167 |
| Надежность | 10.0 | 10.0 |
| Стабильность | 8.4 | 9.2 |
| Попытки | 66/66 | 66/66 |
| Тестов верно | ||
| Доля успешных попыток | 51.5% | 57.6% |
| Нестабильные тесты | 4 | 2 |
| Всего запусков | 66 | 66 |
| Стоимость за результат | 5.467 | 6.212 |
| Общая стоимость | $0.492 | $0.672 |
| Цена входа | $0.300 / 1M | $0.100 / 1M |
| Цена выхода | $1.200 / 1M | $0.900 / 1M |
| Общее число входных токенов | 93,411 | 85,148 |
| Выходные токены | 30,470 | 61,736 |
| Токены рассуждений | 356,172 | 681,556 |
| Время ответа (среднее) | 153.29s | 58.49s |
| Время ответа (макс.) | 941.66s | 817.57s |
| Время ответа (суммарно) | 3372.36s | 1169.83s |
| Параметры | 1.6T всего (48B активных) | 35B всего (3B активных) |
| Доступность | Открытый исходный код | Открытый исходный код |
Генерация showcase моделей
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#160 LongCat 2.0
high
Reached the allocated time limit (600 seconds) without receiving showcase output.
- Стоимость
- $0.000
- Время
- 600.0s
- Токены
- 0 tok
#167 Qwen3.6 35B A3B
medium
Reached the allocated time limit (300 seconds) without receiving showcase output.
- Стоимость
- $0.000
- Время
- 300.0s
- Токены
- 0 tok
Лучшие модели по оценке
Оценка vs общая стоимость
Время ответа (среднее)
Оценка vs Время ответа (среднее)
Общее число выходных токенов
Оценка vs Общее число выходных токенов
Разбивка по категориям
| Анти-ИИ уловки | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 8.9 | 8.1 | 91.7% | 1 | 7.76s | 588 | 303 | 3,300 | |
| Qwen3.6 35B A3B | 10.0 | 10.0 | 100.0% | 0 | 6.02s | 672 | 1,154 | 12,385 |
| Программирование | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 7.8 | 9.3 | 66.7% | 0 | 505.33s | 6,913 | 244 | 192,377 | |
| Qwen3.6 35B A3B | 7.7 | 10.0 | 66.7% | 0 | 50.55s | 5,051 | 7,929 | 37,223 |
| Комбинированный | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 10.0 | 10.0 | 100.0% | 0 | 167.13s | 68,941 | 4,934 | 49,558 | |
| Qwen3.6 35B A3B | 3.0 | 10.0 | 0.0% | 0 | 817.57s | 68,754 | 42,187 | 548,547 |
| Парсинг и извлечение данных | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 3.6 | 5.8 | 33.3% | 1 | 10.98s | 7,653 | 197 | 2,714 | |
| Qwen3.6 35B A3B | 10.0 | 10.0 | 100.0% | 0 | 12.99s | 7,776 | 2,591 | 9,968 |
| Предметно-ориентированное | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 3.6 | 7.2 | 22.2% | 1 | 433.73s | 505 | 23,928 | 86,947 | |
| Qwen3.6 35B A3B | 2.9 | 4.4 | 22.2% | 2 | 25.39s | 780 | 6,110 | 41,906 |
| Общий интеллект | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 5.1 | 10.0 | 0.0% | 0 | 17.00s | 480 | 111 | 1,748 | |
| Qwen3.6 35B A3B | 4.4 | 9.9 | 0.0% | 0 | 8.66s | 516 | 129 | 4,569 |
| Следование инструкциям | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 6.5 | 10.0 | 50.0% | 0 | 6.96s | 657 | 78 | 1,726 | |
| Qwen3.6 35B A3B | 10.0 | 10.0 | 100.0% | 0 | 7.50s | 699 | 219 | 7,404 |
| Решение головоломок | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 3.1 | 7.4 | 11.1% | 1 | 9.18s | 636 | 379 | 2,778 | |
| Qwen3.6 35B A3B | 8.0 | 10.0 | 66.7% | 0 | 5.95s | 696 | 655 | 9,228 |
| Вызов инструментов | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 10.0 | 10.0 | 100.0% | 0 | 10.02s | 6,840 | 249 | 505 | |
| Qwen3.6 35B A3B | 3.0 | 10.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 |
| Эрудиция | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 3.0 | 10.0 | 0.0% | 0 | 99.44s | 198 | 47 | 14,519 | |
| Qwen3.6 35B A3B | 3.0 | 10.0 | 0.0% | 0 | 32.90s | 204 | 762 | 10,326 |
Быстрое сравнение
Сменить пару сравнения
Gemini 3.1 Flash LitelowvsQwen3.6 35B A3BmediumMercury 2.5 PreviewhighvsQwen3.6 35B A3BmediumGemini 3.5 FlashminimalvsLongCat 2.0highGemini 3.1 Flash Lite PreviewlowvsQwen3.6 35B A3BmediumGemini 3.5 Flash LitelowvsQwen3.6 35B A3BmediumGemini 3.5 Flash LitelowvsLongCat 2.0highLongCat 2.0highvsQwen3.5-27BnoneGemini 3.1 Flash Lite PreviewlowvsLongCat 2.0highKAT-Coder-Pro V2.5nonevsLongCat 2.0highLongCat 2.0highvsInkling SmallmediumGemini 3.1 Flash LitelowvsLongCat 2.0highLongCat 2.0highvsGLM 5.2none