Навигация
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

MoonshotAI: Kimi K2.5 vs OpenAI: GPT-5.5

Сводка

Сравнение benchmark Kimi K2.5 vs GPT-5.5: Kimi K2.5 лидирует по среднему баллу: 6.8 vs 6.4. GPT-5.5 имеет более низкую стоимость benchmark: $0.231 vs $0.328. GPT-5.5 быстрее: 1.89s vs 98.43s, с долей успешных попыток 68.3% vs 54.0%.

Рекомендуемая модель: GPT-5.5 - Его балл близок к лучшему здесь (6.4 против 6.8), и он отвечает примерно в 52.1 раза быстрее, чем Kimi K2.5.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-06-04

Метрика Kimi K2.5 Kimi K2.5 medium Релиз: 2026-01-27 GPT-5.5 GPT-5.5 none Релиз: 2026-04-24
Оценка 6.8 6.4
Ранг #76 #91
Надежность 10.0 10.0
Стабильность 6.9 8.8
Тестов верно
Доля успешных попыток 68.3% 54.0%
Нестабильные тесты 8 3
Всего запусков 63 63
Стоимость за результат 3.704 2.302
Общая стоимость $0.328 $0.231
Цена входа $0.400 / 1M $5.000 / 1M
Цена выхода $1.900 / 1M $30.000 / 1M
Общее число входных токенов 34,312 34,212
Выходные токены 48,379 1,971
Токены рассуждений 157,747 0
Время ответа (среднее) 98.43s 1.89s
Время ответа (макс.) 281.00s 5.56s
Время ответа (суммарно) 1378.03s 39.64s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#76 MoonshotAI: Kimi K2.5

medium
Cost
$0.030
Time
58.6s
Tokens
8,683 tok

#91 GPT-5.5

none
Cost
$0.090
Time
54.3s
Tokens
3,063 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Kimi K2.5 7.3 5.8 83.3% 2 51.38s 634 2,789 8,880
GPT-5.5 6.9 7.9 66.7% 1 1.31s 606 213 0
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Kimi K2.5 6.1 4.6 66.7% 2 217.49s 6,935 5,705 74,693
GPT-5.5 5.5 10.0 33.3% 0 1.35s 7,305 462 0
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Kimi K2.5 10.0 10.0 100.0% 0 71.37s 11,280 703 3,713
GPT-5.5 3.0 10.0 0.0% 0 5.56s 11,019 300 0
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Kimi K2.5 10.0 10.0 100.0% 0 49.78s 7,020 563 7,940
GPT-5.5 10.0 10.0 100.0% 0 1.18s 7,140 222 0
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Kimi K2.5 3.5 4.4 33.3% 2 137.29s 485 20,753 30,564
GPT-5.5 2.9 7.2 11.1% 1 1.31s 723 52 0
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Kimi K2.5 6.5 3.4 66.7% 1 69.73s 480 3,815 4,262
GPT-5.5 10.0 10.0 100.0% 0 3.41s 477 124 0
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Kimi K2.5 10.0 10.0 100.0% 0 92.47s 675 5,371 6,547
GPT-5.5 6.2 5.8 66.7% 1 1.15s 660 81 0
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Kimi K2.5 5.3 7.3 44.4% 1 43.23s 659 8,426 12,692
GPT-5.5 7.7 10.0 66.7% 0 1.29s 642 252 0
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Kimi K2.5 10.0 10.0 100.0% 0 31.74s 5,933 242 812
GPT-5.5 10.0 10.0 100.0% 0 3.90s 5,445 247 0
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Kimi K2.5 3.0 10.0 0.0% 0 83.95s 211 12 7,644
GPT-5.5 3.0 10.0 0.0% 0 5.01s 195 18 0

Быстрое сравнение

Сменить пару сравнения