Навигация
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

OpenAI: GPT-5.6 Luna vs Xiaomi: MiMo-V2.5-Pro

MiMo-V2.5-Pro лидирует по среднему баллу: 5.5 vs 5.4. MiMo-V2.5-Pro имеет более низкую стоимость benchmark: $0.068 vs $0.142. GPT-5.6 Luna быстрее: 1.50s vs 4.12s, с долей успешных попыток 34.9% vs 37.9%.

Рекомендуемая модельMiMo-V2.5-ProЗдесь у него лучший балл (5.5), при этом он примерно в 2.1 раза дешевле, чем GPT-5.6 Luna.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-07-22

Метрика GPT-5.6 Luna GPT-5.6 Luna none Релиз: 2026-07-09 MiMo-V2.5-Pro MiMo-V2.5-Pro none Релиз: 2026-04-22
Оценка 5.4 5.5
Ранг #166 #160
Надежность 10.0 10.0
Стабильность 8.8 8.6
Тестов верно
Доля успешных попыток 34.9% 37.9%
Нестабильные тесты 3 4
Всего запусков 66 66
Стоимость за результат 2.360 1.509
Общая стоимость $0.142 $0.068
Цена входа $1.000 / 1M $0.435 / 1M
Цена выхода $6.000 / 1M $0.870 / 1M
Общее число входных токенов 101,323 124,799
Выходные токены 6,709 15,362
Токены рассуждений 0 0
Время ответа (среднее) 1.50s 4.12s
Время ответа (макс.) 10.57s 53.13s
Время ответа (суммарно) 32.91s 90.55s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#166 GPT-5.6 Luna

none
Стоимость
$0.016
Время
15.8s
Токены
2,685 tok

#160 MiMo-V2.5-Pro

none
Стоимость
$0.004
Время
46.4s
Токены
4,025 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
GPT-5.6 Luna 3.8 7.2 22.2% 1 980ms 7,302 459 0
MiMo-V2.5-Pro 4.3 7.8 22.2% 1 1.41s 6,559 485 0

Быстрое сравнение

Сменить пару сравнения