Навигация
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

MiniMax: MiniMax M2.7 vs MoonshotAI: Kimi K2.5

Сводка

Сравнение benchmark MiniMax M2.7 vs Kimi K2.5: Kimi K2.5 лидирует по среднему баллу: 5.5 vs 5.2. Kimi K2.5 имеет более низкую стоимость benchmark: $0.027 vs $0.104. Kimi K2.5 быстрее: 13.18s vs 38.18s, с долей успешных попыток 46.0% vs 34.9%.

Рекомендуемая модель: Kimi K2.5 - Здесь у него лучший балл (5.5), при этом он примерно в 3.9 раза дешевле, чем MiniMax M2.7.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-06-18

Метрика MiniMax M2.7 MiniMax M2.7 medium Релиз: 2026-03-18 Kimi K2.5 Kimi K2.5 none Релиз: 2026-01-27
Оценка 5.2 5.5
Ранг #127 #118
Надежность 10.0 10.0
Стабильность 6.8 8.9
Тестов верно
Доля успешных попыток 46.0% 34.9%
Нестабильные тесты 8 3
Всего запусков 63 63
Стоимость за результат 2.494 0.442
Общая стоимость $0.104 $0.027
Цена входа $0.250 / 1M $0.375 / 1M
Цена выхода $1.000 / 1M $2.025 / 1M
Общее число входных токенов 34,371 36,034
Выходные токены 8,981 6,657
Токены рассуждений 89,812 0
Время ответа (среднее) 38.18s 13.18s
Время ответа (макс.) 196.21s 42.13s
Время ответа (суммарно) 763.60s 184.47s

Генерация showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#127 MiniMax M2.7

medium
Стоимость
$0.022
Время
22.8s
Токены
9,250 tok

#118 MoonshotAI: Kimi K2.5

none
Стоимость
$0.015
Время
89.1s
Токены
5,421 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
MiniMax M2.7 7.9 6.3 83.3% 2 40.32s 654 3,010 17,716
Kimi K2.5 3.6 8.4 8.3% 1 6.24s 652 373 0
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
MiniMax M2.7 5.7 9.1 33.3% 0 101.89s 2,961 1,231 38,841
Kimi K2.5 5.5 10.0 33.3% 0 24.56s 7,311 4,708 0
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
MiniMax M2.7 4.7 1.6 66.7% 1 41.03s 14,233 369 4,480
Kimi K2.5 2.8 2.1 33.3% 1 19.16s 12,264 748 0
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
MiniMax M2.7 6.3 5.8 66.7% 1 21.95s 7,152 187 5,882
Kimi K2.5 7.3 5.8 83.3% 1 42.13s 7,180 187 0
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
MiniMax M2.7 3.0 10.0 0.0% 0 19.00s 245 8 2,796
Kimi K2.5 5.3 10.0 33.3% 0 4.38s 753 29 0
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
MiniMax M2.7 3.9 2.5 33.3% 1 38.70s 486 92 5,204
Kimi K2.5 10.0 10.0 100.0% 0 4.00s 483 76 0
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
MiniMax M2.7 3.8 5.8 33.3% 1 12.80s 687 350 2,600
Kimi K2.5 6.5 10.0 50.0% 0 2.67s 677 60 0
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
MiniMax M2.7 5.9 7.2 55.6% 1 24.87s 675 362 7,840
Kimi K2.5 3.0 10.0 0.0% 0 4.04s 667 236 0
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
MiniMax M2.7 4.7 1.6 66.7% 1 12.05s 7,067 304 1,001
Kimi K2.5 10.0 10.0 100.0% 0 13.99s 5,835 220 0
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
MiniMax M2.7 3.0 10.0 0.0% 0 22.77s 211 3,068 3,452
Kimi K2.5 3.0 10.0 0.0% 0 3.90s 212 20 0

Быстрое сравнение

Сменить пару сравнения