- Ранг
- #134
- Общее число выходных токенов
- 174,547
- Время ответа (среднее)
- 4.32s
- Общая стоимость
- $0.031
Mercury 2.5 (high) vs Qwen3.5-122B-A10B (medium)
Qwen3.5-122B-A10B (medium) лидирует по среднему баллу: 7.1 vs 7.1. Mercury 2.5 (high) имеет более низкую стоимость benchmark: $0.031 vs $1.207. Mercury 2.5 (high) быстрее: 4.32s vs 65.67s, с долей успешных попыток 62.1% vs 71.2%.
Сравниваемые модели
- Ранг
- #130
- Общее число выходных токенов
- 487,519
- Время ответа (среднее)
- 65.67s
- Общая стоимость
- $1.207
Рекомендуемая модель
Mercury 2.5 (high)
Его балл близок к лучшему здесь (7.1 против 7.1), при этом он примерно в 38.9 раза дешевле, чем Qwen3.5-122B-A10B (medium).
Подробное сравнение
| Метрика | Mercury 2.5 Mercury 2.5 high | Qwen3.5-122B-A10B Qwen3.5-122B-A10B medium |
|---|---|---|
| Оценка | 7.1 | 7.1 |
| Ранг | #134 | #130 |
| Надежность | 9.7 | 10.0 |
| Стабильность | 8.6 | 8.5 |
| Попытки | 66/66 | 66/66 |
| Тестов верно | ||
| Доля успешных попыток | 62.1% | 71.2% |
| Нестабильные тесты | 4 | 4 |
| Всего запусков | 66 | 66 |
| Стоимость за результат | 0.259 | 8.446 |
| Общая стоимость | $0.031 | $1.207 |
| Цена входа | $0.040 / 1M | $0.290 / 1M |
| Цена выхода | $0.150 / 1M | $2.400 / 1M |
| Общее число входных токенов | 120,068 | 124,780 |
| Выходные токены | 3,402 | 47,694 |
| Токены рассуждений | 171,145 | 439,825 |
| Время ответа (среднее) | 4.32s | 65.67s |
| Время ответа (макс.) | 23.63s | 519.30s |
| Время ответа (суммарно) | 95.06s | 1444.68s |
| Параметры | ~100B | 122B всего (10B активных) |
| Доступность | Закрытая модель | Открытый исходный код |
Генерация showcase моделей
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#134 Mercury 2.5
high- Стоимость
- $0.001
- Время
- 3.5s
- Токены
- 2,447 tok
#130 Qwen3.5-122B-A10B
medium- Стоимость
- $0.019
- Время
- 48.7s
- Токены
- 6,034 tok
Лучшие модели по оценке
Оценка vs общая стоимость
Время ответа (среднее)
Оценка vs Время ответа (среднее)
Общее число выходных токенов
Оценка vs Общее число выходных токенов
Разбивка по категориям
| Анти-ИИ уловки | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Mercury 2.5 | 10.0 | 10.0 | 100.0% | 0 | 1.33s | 782 | 218 | 7,913 | |
| Qwen3.5-122B-A10B | 10.0 | 10.0 | 100.0% | 0 | 9.75s | 672 | 269 | 16,835 |
| Программирование | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Mercury 2.5 | 6.4 | 7.8 | 44.4% | 1 | 6.58s | 7,757 | 415 | 44,012 | |
| Qwen3.5-122B-A10B | 6.0 | 7.2 | 55.6% | 1 | 114.48s | 7,630 | 8,057 | 82,578 |
| Комбинированный | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Mercury 2.5 | 6.4 | 5.8 | 66.7% | 1 | 16.00s | 91,255 | 1,478 | 62,200 | |
| Qwen3.5-122B-A10B | 6.4 | 5.8 | 66.7% | 1 | 313.55s | 97,886 | 18,373 | 203,450 |
| Парсинг и извлечение данных | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Mercury 2.5 | 10.0 | 10.0 | 100.0% | 0 | 3.08s | 8,355 | 557 | 9,430 | |
| Qwen3.5-122B-A10B | 10.0 | 10.0 | 100.0% | 0 | 23.41s | 7,782 | 270 | 16,558 |
| Предметно-ориентированное | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Mercury 2.5 | 2.9 | 7.2 | 11.1% | 1 | 4.86s | 857 | 78 | 22,452 | |
| Qwen3.5-122B-A10B | 2.9 | 7.2 | 11.1% | 1 | 74.43s | 780 | 19,154 | 61,573 |
| Общий интеллект | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Mercury 2.5 | 5.0 | 10.0 | 0.0% | 0 | 2.69s | 528 | 93 | 3,609 | |
| Qwen3.5-122B-A10B | 3.4 | 2.2 | 33.3% | 1 | 34.11s | 344 | 66 | 7,592 |
| Следование инструкциям | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Mercury 2.5 | 6.5 | 10.0 | 50.0% | 0 | 934ms | 401 | 27 | 1,770 | |
| Qwen3.5-122B-A10B | 10.0 | 10.0 | 100.0% | 0 | 9.88s | 593 | 77 | 7,372 |
| Решение головоломок | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Mercury 2.5 | 8.7 | 7.7 | 88.9% | 1 | 1.39s | 771 | 227 | 5,812 | |
| Qwen3.5-122B-A10B | 10.0 | 10.0 | 100.0% | 0 | 17.89s | 696 | 284 | 27,575 |
| Вызов инструментов | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Mercury 2.5 | 10.0 | 10.0 | 100.0% | 0 | 3.06s | 9,130 | 283 | 4,484 | |
| Qwen3.5-122B-A10B | 10.0 | 10.0 | 100.0% | 0 | 4.60s | 8,193 | 322 | 1,226 |
| Эрудиция | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Mercury 2.5 | 3.0 | 10.0 | 0.0% | 0 | 5.48s | 232 | 26 | 9,463 | |
| Qwen3.5-122B-A10B | 3.0 | 10.0 | 0.0% | 0 | 52.87s | 204 | 822 | 15,066 |
Быстрое сравнение
Сменить пару сравнения
Muse Glimmer 30BlowvsQwen3.5-122B-A10BmediumQwen3.5-122B-A10BmediumvsStep 3.7 FlashlowMercury 2.5highvsGrok 4.3mediumMercury 2.5highvsGPT-5.6 SolnoneQwen3.5-122B-A10BmediumvsSolar Pro 4highMercury 2.5highvsStep 3.7 FlashlowDeepSeek V3.2mediumvsMercury 2.5highMuse Glimmer 30BhighvsQwen3.5-122B-A10BmediumMercury 2.5highvsMuse Glimmer 30BlowMercury 2.5highvsGLM 5.1mediumMercury 2.5highvsGPT-5.5noneKAT-Coder-Pro V2.5highvsQwen3.5-122B-A10Bmedium