Навигация
AI BENCHY
Advertise here

AI BENCHY Compare

MoonshotAI: Kimi K2.7 Code vs Z.ai: GLM 5.2

Сводка

Сравнение benchmark Kimi K2.7 Code vs GLM 5.2: GLM 5.2 лидирует по среднему баллу: 7.1 vs 7.0. GLM 5.2 имеет более низкую стоимость benchmark: $0.076 vs $0.583. GLM 5.2 быстрее: 6.34s vs 83.60s, с долей успешных попыток 66.7% vs 60.3%.

Рекомендуемая модель: GLM 5.2 - Здесь у него лучший балл (7.1), при этом он примерно в 7.7 раза дешевле, чем Kimi K2.7 Code.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-06-17

Метрика Kimi K2.7 Code Kimi K2.7 Code medium Релиз: 2026-06-12 GLM 5.2 GLM 5.2 none Релиз: 2026-06-17
Оценка 7.0 7.1
Ранг #65 #61
Надежность 9.2 9.9
Стабильность 7.7 9.6
Тестов верно
Доля успешных попыток 66.7% 60.3%
Нестабильные тесты 6 1
Всего запусков 63 63
Стоимость за результат 6.074 0.628
Общая стоимость $0.583 $0.076
Цена входа $0.740 / 1M $1.400 / 1M
Цена выхода $3.500 / 1M $4.400 / 1M
Общее число входных токенов 25,991 38,671
Выходные токены 80,516 4,817
Токены рассуждений 161,391 0
Время ответа (среднее) 83.60s 6.34s
Время ответа (макс.) 365.80s 20.69s
Время ответа (суммарно) 1671.99s 133.19s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#65 MoonshotAI: Kimi K2.7 Code

medium
Cost
$0.025
Time
138.0s
Tokens
6,093 tok

#61 GLM 5.2

none
Invalid SVG
Cost
$0.033
Time
87.7s
Tokens
7,455 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Kimi K2.7 Code 7.3 5.8 83.3% 2 11.56s 618 3,048 5,041
GLM 5.2 8.3 10.0 75.0% 0 3.70s 567 313 0
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Kimi K2.7 Code 7.6 7.2 77.8% 1 146.73s 4,650 1,864 25,635
GLM 5.2 3.7 9.5 0.0% 0 7.55s 7,263 1,958 0
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Kimi K2.7 Code 4.7 1.6 66.7% 1 34.83s 11,271 444 3,906
GLM 5.2 10.0 10.0 100.0% 0 20.69s 14,296 1,489 0
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Kimi K2.7 Code 10.0 10.0 100.0% 0 12.27s 7,014 248 2,569
GLM 5.2 10.0 10.0 100.0% 0 7.17s 7,113 204 0
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Kimi K2.7 Code 5.3 7.2 44.4% 1 213.29s 431 55,572 63,639
GLM 5.2 5.3 10.0 33.3% 0 6.50s 696 27 0
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Kimi K2.7 Code 10.0 10.0 100.0% 0 10.78s 477 1,024 1,071
GLM 5.2 6.1 3.1 66.7% 1 4.42s 480 82 0
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Kimi K2.7 Code 9.9 10.0 100.0% 0 5.39s 669 725 1,232
GLM 5.2 9.8 10.0 100.0% 0 3.84s 642 66 0
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Kimi K2.7 Code 5.9 7.7 44.4% 1 41.00s 651 15,438 17,368
GLM 5.2 7.7 10.0 66.7% 0 3.31s 618 265 0
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Kimi K2.7 Code 3.0 10.0 0.0% 0 0ms 0 0 0
GLM 5.2 10.0 10.0 100.0% 0 15.76s 6,807 400 0
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Kimi K2.7 Code 3.0 10.0 0.0% 0 341.76s 210 2,153 40,930
GLM 5.2 3.0 10.0 0.0% 0 3.41s 189 13 0

Быстрое сравнение

Сменить пару сравнения