- Ранг
- #116
- Общее число выходных токенов
- 44,525
- Время ответа (среднее)
- 7.43s
- Общая стоимость
- $0.072
GPT-5.6 Luna (medium) vs Grok Build 0.1 (medium)
Средний балл практически равен: 7.4 vs 7.5. GPT-5.6 Luna (medium) имеет более низкую стоимость benchmark: $0.072 vs $1.130. GPT-5.6 Luna (medium) быстрее: 7.43s vs 54.50s, с долей успешных попыток 62.1% vs 60.6%.
Сравниваемые модели
- Ранг
- #111
- Общее число выходных токенов
- 511,406
- Время ответа (среднее)
- 54.50s
- Общая стоимость
- $1.130
Рекомендуемая модель
GPT-5.6 Luna (medium)
Здесь у него лучший балл (7.4), при этом он примерно в 15.8 раза дешевле, чем Grok Build 0.1 (medium).
Подробное сравнение
| Метрика | GPT-5.6 Luna GPT-5.6 Luna medium | Grok Build 0.1 Grok Build 0.1 medium |
|---|---|---|
| Оценка | 7.4 | 7.5 |
| Ранг | #116 | #111 |
| Надежность | 10.0 | 10.0 |
| Стабильность | 9.2 | 9.6 |
| Попытки | 66/66 | 66/66 |
| Тестов верно | ||
| Доля успешных попыток | 62.1% | 60.6% |
| Нестабильные тесты | 2 | 1 |
| Всего запусков | 66 | 66 |
| Стоимость за результат | 2.601 | 8.691 |
| Общая стоимость | $0.072 | $1.130 |
| Цена входа | $0.200 / 1M | $1.000 / 1M |
| Цена выхода | $1.200 / 1M | $2.000 / 1M |
| Общее число входных токенов | 89,685 | 106,946 |
| Выходные токены | 5,701 | 7,993 |
| Токены рассуждений | 38,824 | 503,413 |
| Время ответа (среднее) | 7.43s | 54.50s |
| Время ответа (макс.) | 29.85s | 252.69s |
| Время ответа (суммарно) | 163.54s | 1199.07s |
| Параметры | ~400B всего (~17B активных) | ~300B всего (~30B активных) |
| Доступность | Закрытая модель | Закрытая модель |
Генерация showcase моделей
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#116 GPT-5.6 Luna
medium- Стоимость
- $0.014
- Время
- 14.6s
- Токены
- 2,362 tok
#111 SpaceXAI: Grok Build 0.1
medium- Стоимость
- $0.028
- Время
- 81.3s
- Токены
- 14,009 tok
Лучшие модели по оценке
Оценка vs общая стоимость
Время ответа (среднее)
Оценка vs Время ответа (среднее)
Общее число выходных токенов
Оценка vs Общее число выходных токенов
Разбивка по категориям
| Анти-ИИ уловки | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| GPT-5.6 Luna | 8.3 | 10.0 | 75.0% | 0 | 2.52s | 606 | 160 | 987 | |
| Grok Build 0.1 | 8.3 | 10.0 | 75.0% | 0 | 7.43s | 2,010 | 220 | 12,162 |
| Программирование | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| GPT-5.6 Luna | 5.4 | 7.2 | 44.4% | 1 | 10.38s | 7,302 | 564 | 9,928 | |
| Grok Build 0.1 | 5.7 | 9.7 | 33.3% | 0 | 108.46s | 8,304 | 1,138 | 161,452 |
| Комбинированный | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| GPT-5.6 Luna | 10.0 | 10.0 | 100.0% | 0 | 14.59s | 66,477 | 3,926 | 4,594 | |
| Grok Build 0.1 | 10.0 | 10.0 | 100.0% | 0 | 65.08s | 75,242 | 5,442 | 65,569 |
| Парсинг и извлечение данных | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| GPT-5.6 Luna | 10.0 | 10.0 | 100.0% | 0 | 1.95s | 7,140 | 234 | 324 | |
| Grok Build 0.1 | 10.0 | 10.0 | 100.0% | 0 | 10.72s | 7,761 | 180 | 8,876 |
| Предметно-ориентированное | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| GPT-5.6 Luna | 2.9 | 7.2 | 11.1% | 1 | 18.45s | 732 | 70 | 17,375 | |
| Grok Build 0.1 | 2.9 | 7.2 | 11.1% | 1 | 175.94s | 1,959 | 492 | 192,037 |
| Общий интеллект | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| GPT-5.6 Luna | 5.1 | 10.0 | 0.0% | 0 | 4.34s | 477 | 112 | 496 | |
| Grok Build 0.1 | 4.4 | 9.9 | 0.0% | 0 | 18.41s | 825 | 76 | 6,345 |
| Следование инструкциям | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| GPT-5.6 Luna | 9.9 | 10.0 | 100.0% | 0 | 2.38s | 660 | 95 | 393 | |
| Grok Build 0.1 | 9.8 | 10.0 | 100.0% | 0 | 12.36s | 1,362 | 57 | 9,599 |
| Решение головоломок | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| GPT-5.6 Luna | 7.8 | 10.0 | 66.7% | 0 | 4.04s | 642 | 255 | 2,104 | |
| Grok Build 0.1 | 7.7 | 10.0 | 66.7% | 0 | 18.26s | 1,689 | 195 | 20,841 |
| Вызов инструментов | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| GPT-5.6 Luna | 10.0 | 10.0 | 100.0% | 0 | 6.02s | 5,454 | 256 | 244 | |
| Grok Build 0.1 | 10.0 | 10.0 | 100.0% | 0 | 13.12s | 7,263 | 180 | 4,969 |
| Эрудиция | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| GPT-5.6 Luna | 3.0 | 10.0 | 0.0% | 0 | 6.64s | 195 | 29 | 2,379 | |
| Grok Build 0.1 | 3.0 | 10.0 | 0.0% | 0 | 53.51s | 531 | 13 | 21,563 |
Быстрое сравнение
Сменить пару сравнения
Gemini 3.8 FlashlowvsGrok Build 0.1mediumGPT-5.6 LunamediumvsQwen3.7 MaxnoneQwen3.7 MaxnonevsGrok Build 0.1mediumGPT 5.3 ChatnonevsGrok Build 0.1mediumGemini 3.8 FlashlowvsGPT-5.6 LunamediumGPT-5.6 TerralowvsGrok Build 0.1mediumGPT-5.6 LunamediumvsQwen3.8 2.4T A95BhighGPT-5.6 LunamediumvsGrok 4.6lowGemini 3 Flash PreviewlowvsGPT-5.6 LunamediumQwen3.8 2.4T A95BhighvsGrok Build 0.1mediumGemini 3 Flash PreviewlowvsGrok Build 0.1mediumClaude Opus 5nonevsGrok Build 0.1medium