Навигация
AI BENCHY
Your ad here

AI BENCHY Compare

ByteDance Seed: Seed-2.0-Lite vs Z.ai: GLM 5 Turbo

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-03-15

Метрика Seed-2.0-Lite Seed-2.0-Lite none Релиз: 2026-02-14 GLM 5 Turbo GLM 5 Turbo medium Релиз: 2026-03-15
Ранг #43 #20
Оценка 6.2 7.9
Стабильность 7.4 7.7
Стоимость за результат 0.214 1.641
Общая стоимость $0.015 $0.165
Тестов верно
Доля успешных попыток 56.3% 75.0%
Нестабильные тесты 5 5
Всего запусков 48 48
Выходные токены 2,743 11,853
Токены рассуждений 0 35,095
Время ответа (среднее) 2.49s 18.84s
Время ответа (макс.) 6.70s 194.23s
Время ответа (суммарно) 39.91s 301.50s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Seed-2.0-Lite 3.0 4.6 22.2% 2 2.93s 703 0
GLM 5 Turbo 10.0 10.0 100.0% 0 5.01s 350 2,600
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Seed-2.0-Lite 3.0 10.0 0.0% 0 6.59s 498 0
GLM 5 Turbo 10.0 10.0 100.0% 0 13.88s 390 2,037
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Seed-2.0-Lite 10.0 10.0 100.0% 0 1.82s 246 0
GLM 5 Turbo 10.0 10.0 100.0% 0 6.19s 577 3,632
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Seed-2.0-Lite 3.6 7.2 22.2% 1 1.33s 17 0
GLM 5 Turbo 2.9 4.4 22.2% 2 71.07s 9,665 19,279
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Seed-2.0-Lite 10.0 10.0 100.0% 0 3.45s 294 0
GLM 5 Turbo 6.1 3.1 66.7% 1 10.05s 60 2,216
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Seed-2.0-Lite 10.0 10.0 100.0% 0 1.06s 73 0
GLM 5 Turbo 10.0 10.0 100.0% 0 5.38s 255 2,183
Puzzle Solving Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Seed-2.0-Lite 5.2 4.4 55.6% 2 2.46s 620 0
GLM 5 Turbo 7.3 5.8 55.6% 2 5.44s 315 2,702
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Seed-2.0-Lite 10.0 10.0 100.0% 0 3.94s 292 0
GLM 5 Turbo 10.0 10.0 100.0% 0 9.84s 241 446

Быстрое сравнение

Сменить пару сравнения