Навигация
AI BENCHY
Advertise here

Claude Fable 5.1 (low) vs DeepSeek V3.2 (medium)

DeepSeek V3.2 (medium) лидирует по среднему баллу: 7.0 vs 6.9. DeepSeek V3.2 (medium) имеет более низкую стоимость benchmark: $0.078 vs $2.565. Claude Fable 5.1 (low) быстрее: 10.33s vs 68.43s, с долей успешных попыток 56.1% vs 65.2%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-09-02

Ранг
#136
Общее число выходных токенов
24,375
Время ответа (среднее)
10.33s
Общая стоимость
$2.565
Ранг
#128
Общее число выходных токенов
128,787
Время ответа (среднее)
68.43s
Общая стоимость
$0.078
Рекомендуемая модель DeepSeek V3.2 (medium)

Здесь у него лучший балл (7.0), при этом он примерно в 33.3 раза дешевле, чем Claude Fable 5.1 (low).

Подробное сравнение

Метрика Claude Fable 5.1 Claude Fable 5.1 low Релиз: 2026-09-02 DeepSeek V3.2 DeepSeek V3.2 medium Релиз: 2025-12-01
Оценка 6.9 7.0
Ранг #136 #128
Надежность 10.0 10.0
Стабильность 9.2 7.4
Попытки 66/66 66/66
Тестов верно
Доля успешных попыток 56.1% 65.2%
Нестабильные тесты 2 7
Всего запусков 66 66
Стоимость за результат 23.315 0.672
Общая стоимость $2.565 $0.078
Цена входа $10.000 / 1M $0.269 / 1M
Цена выхода $50.000 / 1M $0.400 / 1M
Общее число входных токенов 134,582 101,056
Выходные токены 8,955 11,832
Токены рассуждений 15,420 116,955
Время ответа (среднее) 10.33s 68.43s
Время ответа (макс.) 33.10s 376.10s
Время ответа (суммарно) 227.37s 1505.53s
Параметры ~9.5T всего (~878B активных) 671B всего (37B активных)
Доступность Закрытая модель Открытый исходный код

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#136 Claude Fable 5.1

low
Стоимость
$0.126
Время
28.5s
Токены
2,652 tok

#128 DeepSeek V3.2

medium
Стоимость
$0.001
Время
53.6s
Токены
1,932 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Claude Fable 5.1 3.4 10.0 0.0% 0 6.75s 10,608 1,753 0
DeepSeek V3.2 6.0 7.2 55.6% 1 248.68s 5,717 649 52,014

Быстрое сравнение

Сменить пару сравнения