- Ранг
- #390
- Общее число выходных токенов
- 0
- Время ответа (среднее)
- 495ms
- Общая стоимость
- $0.005
GPT-6 Luna Decisions (default) vs Qwen3.5-9B (medium)
Qwen3.5-9B (medium) лидирует по среднему баллу: 4.0 vs 2.4. GPT-6 Luna Decisions (default) имеет более низкую стоимость benchmark: $0.005 vs $0.106. GPT-6 Luna Decisions (default) быстрее: 495ms vs 110.18s, с долей успешных попыток 13.0% vs 26.1%.
Сравниваемые модели
- Ранг
- #360
- Общее число выходных токенов
- 447,247
- Время ответа (среднее)
- 110.18s
- Общая стоимость
- $0.106
Рекомендуемая модель
Qwen3.5-9B (medium)
У него самый высокий балл в этом сравнении (4.0) и лучший общий баланс стоимости и времени ответа среди всех 2 моделей.
Подробное сравнение
| Метрика | GPT-6 Luna Decisions GPT-6 Luna Decisions default | Qwen3.5-9B Qwen3.5-9B medium |
|---|---|---|
| Оценка | 2.4 | 4.0 |
| Ранг | #390 | #360 |
| Надежность | 10.0 | 8.7 |
| Стабильность | 5.2 | 7.9 |
| Попытки | 36/69 | 69/69 |
| Тестов верно | ||
| Доля успешных попыток | 13.0% | 26.1% |
| Нестабильные тесты | 0 | 6 |
| Всего запусков | 36 | 69 |
| Стоимость за результат | 0.159 | 3.523 |
| Общая стоимость | $0.005 | $0.106 |
| Цена входа | $0.100 / 1M | $0.100 / 1M |
| Цена выхода | $0.000 / 1M | $0.150 / 1M |
| Цена чтения из кэша | $0.000 / 1M | Н/Д |
| Цена записи в кэш | $0.000 / 1M | Н/Д |
| Общее число входных токенов | 47,583 | 387,323 |
| Выходные токены | 0 | 48,562 |
| Токены рассуждений | 0 | 410,431 |
| Время ответа (среднее) | 495ms | 110.18s |
| Время ответа (макс.) | 842ms | 569.97s |
| Время ответа (суммарно) | 5.94s | 1873.00s |
| Параметры | ~400B всего (~17B активных) | 9B |
| Доступность | Закрытая модель | Открытый исходный код |
Цены кэша относятся к входным токенам. Чтение повторно использует сохранённые запросы; запись сохраняет их и может стоить дороже. Выходные токены оплачиваются по цене вывода.
Генерация showcase моделей
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#390 GPT-6 Luna Decisions
default
Для этой модели еще не сгенерирован результат showcase.
- Стоимость
- Н/Д
- Время
- -
- Токены
- 0 tok
#360 Qwen3.5-9B
medium- Стоимость
- $0.001
- Время
- 35.9s
- Токены
- 3,030 tok
Лучшие модели по оценке
Оценка vs общая стоимость
Время ответа (среднее)
Оценка vs Время ответа (среднее)
Общее число выходных токенов
Оценка vs Общее число выходных токенов
Разбивка по категориям
| Агентные задачи | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna Decisions | 0.0 | 0.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 | |
| Qwen3.5-9B | 5.2 | 3.2 | 33.3% | 1 | 152.85s | 370,128 | 1,827 | 43,724 |
| Анти-ИИ уловки | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna Decisions | 2.3 | 7.5 | 0.0% | 0 | 436ms | 6,279 | 0 | 0 | |
| Qwen3.5-9B | 5.1 | 5.8 | 50.0% | 2 | 34.44s | 369 | 2,621 | 12,411 |
| Программирование | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna Decisions | 2.5 | 6.7 | 0.0% | 0 | 447ms | 22,197 | 0 | 0 | |
| Qwen3.5-9B | 2.9 | 10.0 | 0.0% | 0 | 100.88s | 2,396 | 7,890 | 41,129 |
| Комбинированный | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna Decisions | 0.0 | 0.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 | |
| Qwen3.5-9B | 3.0 | 10.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 |
| Парсинг и извлечение данных | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna Decisions | 10.0 | 10.0 | 100.0% | 0 | 411ms | 10,998 | 0 | 0 | |
| Qwen3.5-9B | 3.6 | 5.6 | 33.3% | 1 | 87.31s | 4,722 | 1,383 | 32,113 |
| Предметно-ориентированное | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna Decisions | 5.3 | 10.0 | 33.3% | 0 | 554ms | 3,063 | 0 | 0 | |
| Qwen3.5-9B | 3.6 | 7.2 | 22.2% | 1 | 272.50s | 420 | 29,239 | 205,666 |
| Общий интеллект | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna Decisions | 0.0 | 0.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 | |
| Qwen3.5-9B | 2.8 | 1.6 | 33.3% | 1 | 226.38s | 180 | 0 | 30,695 |
| Следование инструкциям | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna Decisions | 1.5 | 5.0 | 0.0% | 0 | 842ms | 4,440 | 0 | 0 | |
| Qwen3.5-9B | 6.5 | 10.0 | 50.0% | 0 | 5.75s | 381 | 491 | 1,824 |
| Решение головоломок | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna Decisions | 1.7 | 3.3 | 0.0% | 0 | 414ms | 606 | 0 | 0 | |
| Qwen3.5-9B | 3.0 | 10.0 | 0.0% | 0 | 32.27s | 376 | 1,593 | 12,026 |
| Вызов инструментов | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna Decisions | 0.0 | 0.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 | |
| Qwen3.5-9B | 10.0 | 10.0 | 100.0% | 0 | 4.31s | 8,283 | 444 | 1,149 |
| Эрудиция | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Luna Decisions | 0.0 | 0.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 | |
| Qwen3.5-9B | 3.0 | 10.0 | 0.0% | 0 | 177.02s | 68 | 3,074 | 29,694 |
Быстрое сравнение
Сменить пару сравнения
Mercury 2.5nonevsQwen3.5-9Bmediumgpt-oss-120bnonevsQwen3.5-9BmediumLing 3.0 TinydefaultvsQwen3.5-9BmediumGranite 4.1 8bdefaultvsQwen3.5-9BmediumNemotron 3.5 LightningnoneБесплатно доступноvsQwen3.5-9BmediumMercury 2nonevsQwen3.5-9BmediumLing 3.0 TinyhighvsQwen3.5-9BmediumLing 3.0 TinylowvsQwen3.5-9BmediumGranite 4.2 8BnonevsQwen3.5-9BmediumTrinity Large PreviewdefaultБесплатно доступноvsQwen3.5-9BmediumKAT Coder AIR V2.5defaultvsQwen3.5-9BmediumNemotron 3 SupernoneБесплатно доступноvsQwen3.5-9Bmedium