- Ранг
- #240
- Общее число выходных токенов
- 627,233
- Время ответа (среднее)
- 265.03s
- Общая стоимость
- $1.456
Mistral Large 4 (medium) vs GPT-6.1 Sol (low)
GPT-6.1 Sol (low) лидирует по среднему баллу: 9.6 vs 6.2. GPT-6.1 Sol (low) имеет более низкую стоимость benchmark: $0.460 vs $1.456. GPT-6.1 Sol (low) быстрее: 7.15s vs 265.03s, с долей успешных попыток 55.1% vs 92.8%.
Сравниваемые модели
- Ранг
- #16
- Общее число выходных токенов
- 13,138
- Время ответа (среднее)
- 7.15s
- Общая стоимость
- $0.460
Рекомендуемая модель
GPT-6.1 Sol (low)
Здесь у него лучший балл (9.6), при этом он примерно в 3.2 раза дешевле, чем Mistral Large 4 (medium).
Подробное сравнение
| Метрика | Mistral Large 4 Mistral Large 4 medium | GPT-6.1 Sol GPT-6.1 Sol low |
|---|---|---|
| Оценка | 6.2 | 9.6 |
| Ранг | #240 | #16 |
| Надежность | 9.2 | 10.0 |
| Стабильность | 7.6 | 9.6 |
| Попытки | 69/69 | 69/69 |
| Тестов верно | ||
| Доля успешных попыток | 55.1% | 92.8% |
| Нестабильные тесты | 7 | 1 |
| Всего запусков | 69 | 69 |
| Стоимость за результат | 16.168 | 2.187 |
| Общая стоимость | $1.456 | $0.460 |
| Цена входа | $0.680 / 1M | $2.000 / 1M |
| Цена выхода | $2.090 / 1M | $10.000 / 1M |
| Цена чтения из кэша | $0.070 / 1M | $0.100 / 1M |
| Цена записи в кэш | Н/Д | $2.500 / 1M |
| Общее число входных токенов | 212,024 | 163,900 |
| Выходные токены | 166,422 | 4,958 |
| Токены рассуждений | 562,095 | 8,180 |
| Время ответа (среднее) | 265.03s | 7.15s |
| Время ответа (макс.) | 1760.20s | 46.57s |
| Время ответа (суммарно) | 6095.69s | 164.47s |
| Параметры | 1.05T всего (49B активных) | ~2T всего (~150B активных) |
| Доступность | Закрытая модель | Закрытая модель |
Цены кэша относятся к входным токенам. Чтение повторно использует сохранённые запросы; запись сохраняет их и может стоить дороже. Выходные токены оплачиваются по цене вывода.
Генерация showcase моделей
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#240 Mistral Large 4
medium- Стоимость
- $0.011
- Время
- 63.4s
- Токены
- 5,291 tok
#16 GPT-6.1 Sol
low- Стоимость
- $0.028
- Время
- 44.6s
- Токены
- 2,881 tok
Лучшие модели по оценке
Оценка vs общая стоимость
Время ответа (среднее)
Оценка vs Время ответа (среднее)
Общее число выходных токенов
Оценка vs Общее число выходных токенов
Разбивка по категориям
| Агентные задачи | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Mistral Large 4 | 6.1 | 3.1 | 66.7% | 1 | 173.21s | 135,844 | 7,482 | 13,709 | |
| GPT-6.1 Sol | 10.0 | 10.0 | 100.0% | 0 | 46.57s | 85,882 | 798 | 461 |
| Анти-ИИ уловки | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Mistral Large 4 | 8.3 | 10.0 | 75.0% | 0 | 15.73s | 705 | 1,087 | 7,308 | |
| GPT-6.1 Sol | 10.0 | 10.0 | 100.0% | 0 | 2.14s | 606 | 147 | 226 |
| Программирование | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Mistral Large 4 | 3.4 | 7.2 | 22.2% | 1 | 1201.87s | 7,189 | 33,530 | 303,140 | |
| GPT-6.1 Sol | 10.0 | 10.0 | 100.0% | 0 | 4.48s | 7,302 | 388 | 1,286 |
| Комбинированный | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Mistral Large 4 | 7.3 | 5.8 | 83.3% | 1 | 510.65s | 51,756 | 8,436 | 82,002 | |
| GPT-6.1 Sol | 10.0 | 10.0 | 100.0% | 0 | 10.94s | 54,810 | 2,619 | 370 |
| Парсинг и извлечение данных | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Mistral Large 4 | 10.0 | 10.0 | 100.0% | 0 | 25.95s | 7,314 | 1,046 | 7,861 | |
| GPT-6.1 Sol | 10.0 | 10.0 | 100.0% | 0 | 1.94s | 7,140 | 222 | 0 |
| Предметно-ориентированное | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Mistral Large 4 | 2.9 | 7.2 | 11.1% | 1 | 288.04s | 798 | 85,691 | 114,373 | |
| GPT-6.1 Sol | 7.7 | 10.0 | 66.7% | 0 | 15.39s | 732 | 69 | 5,195 |
| Общий интеллект | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Mistral Large 4 | 3.5 | 2.2 | 33.3% | 1 | 39.33s | 516 | 4,704 | 4,909 | |
| GPT-6.1 Sol | 10.0 | 10.0 | 100.0% | 0 | 3.66s | 477 | 114 | 142 |
| Следование инструкциям | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Mistral Large 4 | 8.3 | 10.0 | 50.0% | 0 | 24.62s | 708 | 6,709 | 7,691 | |
| GPT-6.1 Sol | 10.0 | 10.0 | 100.0% | 0 | 2.21s | 660 | 93 | 115 |
| Решение головоломок | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Mistral Large 4 | 6.1 | 4.7 | 66.7% | 2 | 41.40s | 717 | 8,254 | 10,519 | |
| GPT-6.1 Sol | 10.0 | 10.0 | 100.0% | 0 | 2.19s | 642 | 232 | 88 |
| Вызов инструментов | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Mistral Large 4 | 10.0 | 10.0 | 100.0% | 0 | 19.19s | 6,267 | 303 | 1,104 | |
| GPT-6.1 Sol | 10.0 | 10.0 | 100.0% | 0 | 5.53s | 5,454 | 246 | 0 |
| Эрудиция | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| Mistral Large 4 | 3.0 | 10.0 | 0.0% | 0 | 84.68s | 210 | 9,180 | 9,479 | |
| GPT-6.1 Sol | 2.8 | 1.6 | 33.3% | 1 | 3.80s | 195 | 30 | 297 |
Быстрое сравнение
Сменить пару сравнения
Gemini 3 Flash PreviewmediumvsGPT-6.1 SollowClaude Fable 5.1lowvsMistral Large 4mediumGemini 3.5 FlashnonevsMistral Large 4mediumGemini 3.1 Flash Lite PreviewnonevsMistral Large 4mediumGemini 3.7 FlashmediumvsGPT-6.1 SollowDeepSeek V4 Flash 0731nonevsMistral Large 4mediumApodex 1.1 MinilowБесплатно доступноvsMistral Large 4mediumMistral Large 4mediumvsInklingnoneБесплатно доступноMistral Large 4mediumvsQwen3.5 Plus 2026-04-20noneMistral Large 4mediumvsSpace Bunny AlphaxhighKAT-Coder-Pro V2.5defaultvsMistral Large 4mediumDeepSeek V4 Flash 0423nonevsMistral Large 4medium