- Ранг
- #334
- Общее число выходных токенов
- 57,866
- Время ответа (среднее)
- 22.44s
- Общая стоимость
- $0.119
DeepSeek V3.2 vs KAT Coder AIR V2.5 (default)
DeepSeek V3.2 лидирует по среднему баллу: 4.6 vs 4.4. KAT Coder AIR V2.5 (default) имеет более низкую стоимость benchmark: $0.070 vs $0.119. KAT Coder AIR V2.5 (default) быстрее: 11.96s vs 22.44s, с долей успешных попыток 34.8% vs 34.8%.
Сравниваемые модели
- Ранг
- #348
- Общее число выходных токенов
- 97,752
- Время ответа (среднее)
- 11.96s
- Общая стоимость
- $0.070
Рекомендуемая модель
KAT Coder AIR V2.5 (default)
Его балл близок к лучшему здесь (4.4 против 4.6), при этом он примерно в 1.7 раза дешевле, чем DeepSeek V3.2.
Подробное сравнение
| Метрика | DeepSeek V3.2 DeepSeek V3.2 none | KAT Coder AIR V2.5 KAT Coder AIR V2.5 default |
|---|---|---|
| Оценка | 4.6 | 4.4 |
| Ранг | #334 | #348 |
| Надежность | 10.0 | 10.0 |
| Стабильность | 8.2 | 7.4 |
| Попытки | 69/69 | 69/69 |
| Тестов верно | ||
| Доля успешных попыток | 34.8% | 34.8% |
| Нестабильные тесты | 5 | 7 |
| Всего запусков | 69 | 69 |
| Стоимость за результат | 1.943 | 1.382 |
| Общая стоимость | $0.119 | $0.070 |
| Цена входа | $0.280 / 1M | $0.150 / 1M |
| Цена выхода | $0.420 / 1M | $0.600 / 1M |
| Цена чтения из кэша | $0.028 / 1M | Н/Д |
| Цена записи в кэш | Н/Д | Н/Д |
| Общее число входных токенов | 342,158 | 69,376 |
| Выходные токены | 32,853 | 7,792 |
| Токены рассуждений | 25,013 | 89,960 |
| Время ответа (среднее) | 22.44s | 11.96s |
| Время ответа (макс.) | 122.50s | 121.05s |
| Время ответа (суммарно) | 516.03s | 275.18s |
| Параметры | 671B всего (37B активных) | ~35B всего (~3B активных) |
| Доступность | Открытый исходный код | Закрытая модель |
Цены кэша относятся к входным токенам. Чтение повторно использует сохранённые запросы; запись сохраняет их и может стоить дороже. Выходные токены оплачиваются по цене вывода.
Генерация showcase моделей
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#334 DeepSeek V3.2
none- Стоимость
- $0.002
- Время
- 7.0s
- Токены
- 1,046 tok
#348 KAT Coder AIR V2.5
default- Стоимость
- $0.002
- Время
- 14.5s
- Токены
- 2,619 tok
Лучшие модели по оценке
Оценка vs общая стоимость
Время ответа (среднее)
Оценка vs Время ответа (среднее)
Общее число выходных токенов
Оценка vs Общее число выходных токенов
Разбивка по категориям
| Агентные задачи | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V3.2 | 3.0 | 10.0 | 0.0% | 0 | 122.50s | 206,327 | 15,767 | 0 | |
| KAT Coder AIR V2.5 | 3.0 | 10.0 | 0.0% | 0 | 1.07s | 0 | 0 | 0 |
| Анти-ИИ уловки | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V3.2 | 3.2 | 8.0 | 8.3% | 1 | 9.35s | 494 | 1,073 | 0 | |
| KAT Coder AIR V2.5 | 5.3 | 5.6 | 50.0% | 2 | 2.68s | 672 | 686 | 2,358 |
| Программирование | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V3.2 | 3.1 | 6.9 | 11.1% | 1 | 14.54s | 7,279 | 4,528 | 0 | |
| KAT Coder AIR V2.5 | 3.3 | 9.6 | 0.0% | 0 | 14.31s | 6,472 | 2,032 | 14,886 |
| Комбинированный | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V3.2 | 4.8 | 10.0 | 0.0% | 0 | 113.53s | 109,626 | 10,550 | 23,269 | |
| KAT Coder AIR V2.5 | 3.8 | 1.6 | 50.0% | 2 | 73.00s | 43,170 | 2,531 | 48,237 |
| Парсинг и извлечение данных | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V3.2 | 6.3 | 5.8 | 66.7% | 1 | 9.42s | 7,890 | 210 | 1,500 | |
| KAT Coder AIR V2.5 | 6.3 | 5.8 | 66.7% | 1 | 2.66s | 7,776 | 280 | 988 |
| Предметно-ориентированное | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V3.2 | 3.0 | 10.0 | 0.0% | 0 | 1.48s | 675 | 23 | 0 | |
| KAT Coder AIR V2.5 | 3.0 | 10.0 | 0.0% | 0 | 8.33s | 780 | 1,399 | 10,258 |
| Общий интеллект | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V3.2 | 4.7 | 1.6 | 66.7% | 1 | 9.32s | 314 | 43 | 0 | |
| KAT Coder AIR V2.5 | 5.0 | 10.0 | 0.0% | 0 | 12.02s | 516 | 141 | 515 |
| Следование инструкциям | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V3.2 | 10.0 | 10.0 | 100.0% | 0 | 1.52s | 627 | 66 | 0 | |
| KAT Coder AIR V2.5 | 9.9 | 10.0 | 100.0% | 0 | 1.75s | 699 | 90 | 768 |
| Решение головоломок | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V3.2 | 7.6 | 7.2 | 77.8% | 1 | 6.91s | 424 | 298 | 0 | |
| KAT Coder AIR V2.5 | 2.9 | 4.4 | 22.2% | 2 | 1.84s | 696 | 284 | 971 |
| Вызов инструментов | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V3.2 | 10.0 | 10.0 | 100.0% | 0 | 11.85s | 8,319 | 278 | 244 | |
| KAT Coder AIR V2.5 | 10.0 | 10.0 | 100.0% | 0 | 5.13s | 8,391 | 330 | 1,230 |
| Эрудиция | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V3.2 | 3.0 | 10.0 | 0.0% | 0 | 17.23s | 183 | 17 | 0 | |
| KAT Coder AIR V2.5 | 3.0 | 10.0 | 0.0% | 0 | 17.96s | 204 | 19 | 9,749 |
Быстрое сравнение
Сменить пару сравнения
KAT Coder AIR V2.5defaultvsNemotron 3 SupernoneБесплатно доступноGranite 4.2 8BnonevsKAT Coder AIR V2.5defaultDeepSeek V3.2nonevsQwen3 Coder NextmediumDeepSeek V3.2nonevsLaguna S 2.1lowБесплатно доступноDeepSeek V3.2nonevsGranite 4.2 8BhighDeepSeek V3.2nonevsNemotron 3.5 LightninglowБесплатно доступноCobuddymediumБесплатно доступноvsKAT Coder AIR V2.5defaultNorth Mini CodedefaultБесплатно доступноvsDeepSeek V3.2noneMercury 2nonevsKAT Coder AIR V2.5defaultDeepSeek V3.2nonevsNemotron 3.5 LightningmediumБесплатно доступноDeepSeek V3.2nonevsMercury 2.5 PreviewdefaultDeepSeek V3.2nonevsLing 2.6 Flashdefault