Навигация
AI BENCHY
Advertise here

AI BENCHY Compare

MoonshotAI: Kimi K2.5 vs OpenAI: GPT-5.2

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-05-19

Метрика Kimi K2.5 Kimi K2.5 medium Релиз: 2026-01-27 GPT-5.2 GPT-5.2 medium Релиз: 2025-12-11
Оценка 6.8 7.2
Ранг #76 #65
Надежность 10.0 10.0
Стабильность 7.0 8.2
Тестов верно
Доля успешных попыток 68.4% 68.4%
Нестабильные тесты 7 4
Всего запусков 57 57
Стоимость за результат 2.616 3.609
Общая стоимость $0.236 $0.397
???? ????? $0.400 / 1M $1.750 / 1M
???? ?????? $1.900 / 1M $14.000 / 1M
Выходные токены 42,188 2,731
Токены рассуждений 92,514 22,200
Время ответа (среднее) 73.39s 15.22s
Время ответа (макс.) 150.77s 77.80s
Время ответа (суммарно) 880.65s 182.59s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Kimi K2.5 7.3 5.8 83.3% 2 51.38s 2,789 8,880
GPT-5.2 6.5 8.0 58.3% 1 7.81s 567 2,002
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Kimi K2.5 4.7 1.6 66.7% 1 150.77s 1,269 9,749
GPT-5.2 10.0 10.0 100.0% 0 15.12s 467 2,166
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Kimi K2.5 10.0 10.0 100.0% 0 71.37s 703 3,713
GPT-5.2 10.0 10.0 100.0% 0 14.06s 291 1,757
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Kimi K2.5 10.0 10.0 100.0% 0 49.78s 563 7,940
GPT-5.2 10.0 10.0 100.0% 0 3.15s 234 420
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Kimi K2.5 3.5 4.4 33.3% 2 137.29s 20,753 30,564
GPT-5.2 5.9 7.2 55.6% 1 77.80s 42 10,342
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Kimi K2.5 6.5 3.4 66.7% 1 69.73s 3,815 4,262
GPT-5.2 3.7 9.7 0.0% 0 4.32s 162 269
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Kimi K2.5 10.0 10.0 100.0% 0 92.47s 5,371 6,547
GPT-5.2 9.9 10.0 100.0% 0 3.12s 94 614
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Kimi K2.5 5.3 7.3 44.4% 1 45.40s 6,671 12,403
GPT-5.2 7.6 7.3 77.8% 1 5.47s 609 938
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Kimi K2.5 10.0 10.0 100.0% 0 31.74s 242 812
GPT-5.2 4.7 1.6 66.7% 1 10.30s 239 469
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Kimi K2.5 3.0 10.0 0.0% 0 83.95s 12 7,644
GPT-5.2 3.0 10.0 0.0% 0 28.18s 26 3,223

Быстрое сравнение

Сменить пару сравнения