Навигация
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Seed-2.0-Lite (medium) vs Qwen3.8 27B (medium)

Средний балл практически равен: 7.8 vs 7.8. Стоимость локального оборудования не измерялась, поэтому сравнение стоимости недоступно. Qwen3.8 27B (medium) быстрее: 33.05s vs 47.94s, с долей успешных попыток 69.7% vs 66.7%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-08-15

Ранг
#69
Общее число выходных токенов
101,296
Время ответа (среднее)
47.94s
Общая стоимость
$0.236
Ранг
#68
Общее число выходных токенов
136,162
Время ответа (среднее)
33.05s
Общая стоимость
Н/Д
Рекомендуемая модель Seed-2.0-Lite (medium)

У него самый высокий балл в этом сравнении (7.8) и лучший общий баланс стоимости и времени ответа среди всех 2 моделей.

Подробное сравнение

Метрика Seed-2.0-Lite Seed-2.0-Lite medium Релиз: 2026-02-14 Qwen3.8 27B Qwen3.8 27B medium Релиз: 2026-08-14
Оценка 7.8 7.8
Ранг #69 #68
Надежность 10.0 9.6
Стабильность 8.6 9.7
Попытки 66/66 66/66
Тестов верно
Доля успешных попыток 69.7% 66.7%
Нестабильные тесты 4 1
Всего запусков 66 66
Стоимость за результат 1.809 Н/Д
Общая стоимость $0.236 Н/Д
Цена входа $0.250 / 1M Н/Д
Цена выхода $2.000 / 1M Н/Д
Общее число входных токенов 129,906 98,266
Выходные токены 12,530 1,861
Токены рассуждений 88,766 134,301
Время ответа (среднее) 47.94s 33.05s
Время ответа (макс.) 254.92s 214.63s
Время ответа (суммарно) 1054.57s 694.04s
Параметры ~200B всего (~20B активных) 27.3B
Доступность Закрытая модель Веса доступны

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#69 Seed-2.0-Lite

medium
Стоимость
$0.005
Время
86.7s
Токены
2,354 tok

#68 Qwen3.8 27B

medium
Стоимость
Н/Д
Время
43.4s
Токены
2,956 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Seed-2.0-Lite 8.0 9.8 66.7% 0 156.74s 8,247 458 31,890
Qwen3.8 27B 10.0 10.0 100.0% 0 40.50s 7,893 585 26,808

Быстрое сравнение

Сменить пару сравнения

Claude Opus 4.8lowvsSeed-2.0-LitemediumSeed-2.0-LitemediumvsQwen3.7 FlashhighClaude Opus 4.8lowvsQwen3.8 27BmediumSeed-2.0-CodelowvsQwen3.8 27BmediumSeed-2.0-LitemediumvsDeepSeek V4 ProhighDeepSeek V4 ProhighvsQwen3.8 27BmediumSeed-2.0-LitemediumvsDeepSeek V4 Flash 0423highGPT-5.2 ChatnonevsQwen3.8 27BmediumDeepSeek V4 Flash 0423highvsQwen3.8 27BmediumSeed-2.0-LitemediumvsQwen3.8 27BlowKimi K3maxvsQwen3.8 27BmediumSeed-2.0-LitemediumvsGPT-5.2 Chatnone