Навигация
AI BENCHY
Advertise here

AI BENCHY Compare

OpenAI: GPT-5.5 vs Xiaomi: MiMo-V2.5

Сводка

Сравнение benchmark GPT-5.5 vs MiMo-V2.5: MiMo-V2.5 лидирует по среднему баллу: 6.7 vs 6.3. MiMo-V2.5 имеет более низкую стоимость benchmark: $0.063 vs $0.231. GPT-5.5 быстрее: 1.89s vs 27.11s, с долей успешных попыток 54.0% vs 69.8%.

Рекомендуемая модель: MiMo-V2.5 - Здесь у него лучший балл (6.7), при этом он примерно в 3.7 раза дешевле, чем GPT-5.5.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-06-18

Метрика GPT-5.5 GPT-5.5 none Релиз: 2026-04-24 MiMo-V2.5 MiMo-V2.5 medium Релиз: 2026-04-22
Оценка 6.3 6.7
Ранг #90 #76
Надежность 10.0 10.0
Стабильность 8.8 8.1
Тестов верно
Доля успешных попыток 54.0% 69.8%
Нестабильные тесты 3 5
Всего запусков 63 63
Стоимость за результат 2.302 2.966
Общая стоимость $0.231 $0.063
Цена входа $5.000 / 1M $0.140 / 1M
Цена выхода $30.000 / 1M $0.280 / 1M
Общее число входных токенов 34,212 41,838
Выходные токены 1,971 2,827
Токены рассуждений 0 198,898
Время ответа (среднее) 1.89s 27.11s
Время ответа (макс.) 5.56s 162.44s
Время ответа (суммарно) 39.64s 569.38s

Генерация showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#90 GPT-5.5

none
Стоимость
$0.090
Время
54.3s
Токены
3,063 tok

#76 MiMo-V2.5

medium
Стоимость
$0.002
Время
54.8s
Токены
5,247 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
GPT-5.5 6.9 7.9 66.7% 1 1.31s 606 213 0
MiMo-V2.5 10.0 10.0 100.0% 0 4.14s 621 281 1,739
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
GPT-5.5 5.5 10.0 33.3% 0 1.35s 7,305 462 0
MiMo-V2.5 6.2 4.7 66.7% 2 97.14s 7,422 557 81,977
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
GPT-5.5 3.0 10.0 0.0% 0 5.56s 11,019 300 0
MiMo-V2.5 10.0 10.0 100.0% 0 16.86s 15,060 363 7,609
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
GPT-5.5 10.0 10.0 100.0% 0 1.18s 7,140 222 0
MiMo-V2.5 2.7 5.7 16.7% 1 6.33s 7,746 306 5,714
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
GPT-5.5 2.9 7.2 11.1% 1 1.31s 723 52 0
MiMo-V2.5 5.3 10.0 33.3% 0 34.53s 735 507 49,478
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
GPT-5.5 10.0 10.0 100.0% 0 3.41s 477 124 0
MiMo-V2.5 5.4 2.5 66.7% 1 5.37s 492 121 418
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
GPT-5.5 6.2 5.8 66.7% 1 1.15s 660 81 0
MiMo-V2.5 9.9 10.0 100.0% 0 1.80s 672 88 801
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
GPT-5.5 7.7 10.0 66.7% 0 1.29s 642 252 0
MiMo-V2.5 8.2 7.2 88.9% 1 20.25s 660 279 33,254
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
GPT-5.5 10.0 10.0 100.0% 0 3.90s 5,445 247 0
MiMo-V2.5 10.0 10.0 100.0% 0 7.29s 8,220 303 2,424
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
GPT-5.5 3.0 10.0 0.0% 0 5.01s 195 18 0
MiMo-V2.5 3.0 10.0 0.0% 0 51.29s 210 22 15,484

Быстрое сравнение

Сменить пару сравнения