Навигация
AI BENCHY
Advertise here

AI BENCHY Compare

Cobuddy vs DeepSeek: DeepSeek V3.2

Сводка

Сравнение benchmark Cobuddy vs DeepSeek V3.2: DeepSeek V3.2 лидирует по среднему баллу: 5.3 vs 4.9. Cobuddy имеет более низкую стоимость benchmark: $0.000 vs $0.017. DeepSeek V3.2 быстрее: 13.83s vs 39.90s, с долей успешных попыток 47.6% vs 39.7%.

Рекомендуемая модель: DeepSeek V3.2 - Здесь у него лучший балл (5.3), и он отвечает примерно в 2.9 раза быстрее, чем Cobuddy.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-06-18

Метрика Cobuddy Cobuddy medium Релиз: 2026-05-06 DeepSeek V3.2 DeepSeek V3.2 none Релиз: 2025-12-01
Оценка 4.9 5.3
Ранг #140 #126
Надежность 10.0 10.0
Стабильность 7.5 7.6
Тестов верно
Доля успешных попыток 47.6% 39.7%
Нестабильные тесты 6 6
Всего запусков 63 63
Стоимость за результат 0.000 0.306
Общая стоимость $0.000 $0.017
Цена входа $0.000 / 1M $0.229 / 1M
Цена выхода $0.000 / 1M $0.344 / 1M
Общее число входных токенов 37,449 55,997
Выходные токены 1,677 11,165
Токены рассуждений 116,703 0
Время ответа (среднее) 39.90s 13.83s
Время ответа (макс.) 309.02s 115.89s
Время ответа (суммарно) 797.98s 290.43s

Генерация showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#140 Cobuddy

medium
No endpoints found for baidu/cobuddy:free.
Стоимость
$0.000
Время
0.1s
Токены
0 tok

#126 DeepSeek V3.2

none
Стоимость
$0.002
Время
7.0s
Токены
1,046 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Cobuddy 8.7 7.9 91.7% 1 10.00s 453 98 4,666
DeepSeek V3.2 3.2 8.0 8.3% 1 9.35s 494 1,073 0
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Cobuddy 3.7 6.7 22.2% 1 79.17s 4,726 358 30,138
DeepSeek V3.2 3.1 6.9 11.1% 1 14.54s 7,279 4,528 0
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Cobuddy 3.0 10.0 0.0% 0 47.38s 18,324 465 7,265
DeepSeek V3.2 6.5 10.0 0.0% 0 115.89s 29,843 2,887 0
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Cobuddy 6.3 5.8 66.7% 1 17.36s 8,181 275 5,591
DeepSeek V3.2 6.3 5.8 66.7% 1 9.42s 7,890 1,710 0
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Cobuddy 2.9 4.4 22.2% 2 128.15s 540 10 49,454
DeepSeek V3.2 2.9 7.2 11.1% 1 4.17s 624 21 0
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Cobuddy 4.2 9.9 0.0% 0 23.23s 498 76 3,782
DeepSeek V3.2 4.7 1.6 66.7% 1 9.32s 314 43 0
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Cobuddy 9.8 10.0 100.0% 0 11.60s 508 64 2,842
DeepSeek V3.2 10.0 10.0 100.0% 0 1.52s 627 66 0
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Cobuddy 3.6 7.2 22.2% 1 12.83s 561 189 5,808
DeepSeek V3.2 7.6 7.2 77.8% 1 6.91s 424 298 0
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Cobuddy 10.0 10.0 100.0% 0 11.19s 3,505 133 294
DeepSeek V3.2 10.0 10.0 100.0% 0 11.85s 8,319 522 0
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Cobuddy 3.0 10.0 0.0% 0 36.98s 153 9 6,863
DeepSeek V3.2 3.0 10.0 0.0% 0 17.23s 183 17 0

Быстрое сравнение

Сменить пару сравнения