Навигация
AI BENCHY
Your ad here

AI BENCHY Compare

Google: Gemini 3.1 Flash Lite Preview vs Z.ai: GLM 5.1

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-04-07

Метрика Gemini 3.1 Flash Lite Preview Gemini 3.1 Flash Lite Preview none Релиз: 2026-03-03 GLM 5.1 GLM 5.1 medium Релиз: 2026-04-07
Оценка 7.8 8.0
Ранг #30 #23
Стабильность 9.6 9.0
Тестов верно
Доля успешных попыток 68.6% 76.5%
Нестабильные тесты 1 2
Всего запусков 51 51
Стоимость за результат 0.131 1.270
Общая стоимость $0.015 $0.153
???? ????? $0.250 / 1M $1.000 / 1M
???? ?????? $1.500 / 1M $3.200 / 1M
Выходные токены 4,721 6,666
Токены рассуждений 0 35,313
Время ответа (среднее) 1.29s 18.23s
Время ответа (макс.) 3.39s 43.11s
Время ответа (суммарно) 21.95s 291.73s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite Preview 7.5 8.4 66.7% 1 1.04s 1,092 0
GLM 5.1 10.0 10.0 100.0% 0 8.31s 401 5,122
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite Preview 3.0 10.0 0.0% 0 3.20s 339 0
GLM 5.1 9.5 10.0 100.0% 0 43.11s 327 4,206
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 1.22s 399 0
GLM 5.1 10.0 10.0 100.0% 0 9.33s 991 4,552
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite Preview 5.3 10.0 33.3% 0 942ms 568 0
GLM 5.1 5.3 10.0 33.3% 0 29.77s 969 11,314
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite Preview 4.0 10.0 0.0% 0 741ms 69 0
GLM 5.1 10.0 10.0 100.0% 0 20.95s 2,875 2,875
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 1.13s 574 0
GLM 5.1 6.4 5.8 66.7% 1 7.47s 204 1,617
Puzzle Solving Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 972ms 898 0
GLM 5.1 8.2 7.2 88.9% 1 23.85s 899 5,627
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 3.39s 782 0
GLM 5.1 3.0 10.0 0.0% 0 0ms 0 0

Быстрое сравнение

Сменить пару сравнения