- Ранг
- #300
- Общее число выходных токенов
- 3,627
- Время ответа (среднее)
- 4.16s
- Общая стоимость
- $0.024
GPT-4o-mini vs Laguna S 2.1 (medium)
Laguna S 2.1 (medium) лидирует по среднему баллу: 5.0 vs 5.0. GPT-4o-mini имеет более низкую стоимость benchmark: $0.024 vs $0.080. GPT-4o-mini быстрее: 4.16s vs 63.06s, с долей успешных попыток 21.7% vs 24.6%.
Сравниваемые модели
- Ранг
- #296
- Общее число выходных токенов
- 386,824
- Время ответа (среднее)
- 63.06s
- Общая стоимость
- $0.080
Рекомендуемая модель
GPT-4o-mini
Его балл близок к лучшему здесь (5.0 против 5.0), при этом он примерно в 3.3 раза дешевле, чем Laguna S 2.1 (medium).
Подробное сравнение
| Метрика | GPT-4o-mini GPT-4o-mini none | Laguna S 2.1 Laguna S 2.1 medium Бесплатно доступно |
|---|---|---|
| Оценка | 5.0 | 5.0 |
| Ранг | #300 | #296 |
| Надежность | 10.0 | 10.0 |
| Стабильность | 9.9 | 8.5 |
| Попытки | 69/69 | 69/69 |
| Тестов верно | ||
| Доля успешных попыток | 21.7% | 24.6% |
| Нестабильные тесты | 0 | 4 |
| Всего запусков | 69 | 69 |
| Стоимость за результат | 0.480 | 1.987 |
| Общая стоимость | $0.024 | $0.080 |
| Цена входа | $0.150 / 1M | $0.090 / 1M |
| Цена выхода | $0.600 / 1M | $0.180 / 1M |
| Общее число входных токенов | 145,180 | 230,291 |
| Выходные токены | 3,627 | 99,030 |
| Токены рассуждений | 0 | 287,794 |
| Время ответа (среднее) | 4.16s | 63.06s |
| Время ответа (макс.) | 39.99s | 560.31s |
| Время ответа (суммарно) | 70.70s | 1450.31s |
| Параметры | ~8B | 118B всего (8B активных) |
| Доступность | Закрытая модель | Веса доступны |
Генерация showcase моделей
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#300 GPT-4o-mini
none- Стоимость
- $0.001
- Время
- 6.6s
- Токены
- 742 tok
#296 Laguna S 2.1
medium- Стоимость
- $0.001
- Время
- 4.0s
- Токены
- 867 tok
Лучшие модели по оценке
Оценка vs общая стоимость
Время ответа (среднее)
Оценка vs Время ответа (среднее)
Общее число выходных токенов
Оценка vs Общее число выходных токенов
Разбивка по категориям
| Агентные задачи | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| GPT-4o-mini | 5.0 | 10.0 | 0.0% | 0 | 39.99s | 92,035 | 714 | 0 | |
| Laguna S 2.1 | 3.4 | 2.2 | 33.3% | 1 | 165.05s | 143,644 | 1,732 | 45,497 |
| Анти-ИИ уловки | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| GPT-4o-mini | 4.8 | 10.0 | 25.0% | 0 | 1.34s | 618 | 186 | 0 | |
| Laguna S 2.1 | 3.4 | 5.8 | 25.0% | 2 | 51.82s | 672 | 370 | 45,172 |
| Программирование | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| GPT-4o-mini | 3.2 | 9.6 | 0.0% | 0 | 1.63s | 7,314 | 367 | 0 | |
| Laguna S 2.1 | 5.3 | 7.2 | 44.4% | 1 | 158.98s | 7,917 | 93,354 | 106,718 |
| Комбинированный | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| GPT-4o-mini | 3.0 | 10.0 | 0.0% | 0 | 6.32s | 29,916 | 1,497 | 0 | |
| Laguna S 2.1 | 3.2 | 9.1 | 0.0% | 0 | 284.71s | 60,785 | 2,413 | 80,089 |
| Парсинг и извлечение данных | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| GPT-4o-mini | 10.0 | 10.0 | 100.0% | 0 | 1.27s | 7,161 | 183 | 0 | |
| Laguna S 2.1 | 10.0 | 10.0 | 100.0% | 0 | 2.42s | 7,689 | 243 | 1,699 |
| Предметно-ориентированное | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| GPT-4o-mini | 3.0 | 10.0 | 0.0% | 0 | 743ms | 741 | 17 | 0 | |
| Laguna S 2.1 | 3.0 | 10.0 | 0.0% | 0 | 2.68s | 771 | 24 | 2,863 |
| Общий интеллект | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| GPT-4o-mini | 4.0 | 10.0 | 0.0% | 0 | 909ms | 480 | 66 | 0 | |
| Laguna S 2.1 | 4.6 | 9.8 | 0.0% | 0 | 739ms | 513 | 164 | 0 |
| Следование инструкциям | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| GPT-4o-mini | 6.3 | 10.0 | 50.0% | 0 | 1.11s | 666 | 69 | 0 | |
| Laguna S 2.1 | 4.2 | 9.9 | 0.0% | 0 | 400ms | 702 | 57 | 0 |
| Решение головоломок | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| GPT-4o-mini | 3.5 | 10.0 | 0.0% | 0 | 1.21s | 651 | 308 | 0 | |
| Laguna S 2.1 | 3.1 | 10.0 | 0.0% | 0 | 2.62s | 699 | 375 | 2,497 |
| Вызов инструментов | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| GPT-4o-mini | 10.0 | 10.0 | 100.0% | 0 | 2.51s | 5,400 | 205 | 0 | |
| Laguna S 2.1 | 10.0 | 10.0 | 100.0% | 0 | 2.24s | 6,747 | 270 | 420 |
| Эрудиция | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| GPT-4o-mini | 3.0 | 10.0 | 0.0% | 0 | 794ms | 198 | 15 | 0 | |
| Laguna S 2.1 | 3.0 | 10.0 | 0.0% | 0 | 7.11s | 152 | 28 | 2,839 |
Быстрое сравнение
Сменить пару сравнения
KAT Coder AIR V2.5lowvsGPT-4o-mininoneMiniMax M2.7mediumvsGPT-4o-mininoneMercury 2.5 PreviewlowvsLaguna S 2.1mediumБесплатно доступноMercury 2.5 PreviewlowvsGPT-4o-mininoneLaguna S 2.1mediumБесплатно доступноvsMiMo-V2.5-PrononeMercury 2.5lowvsLaguna S 2.1mediumБесплатно доступноDots 3 Note PreviewnoneБесплатно доступноvsLaguna S 2.1mediumБесплатно доступноGPT-4o-mininonevsLaguna S 2.1highБесплатно доступноMistral Small 4nonevsLaguna S 2.1mediumБесплатно доступноKAT Coder AIR V2.5lowvsLaguna S 2.1mediumБесплатно доступноKAT Coder AIR V2.5highvsLaguna S 2.1mediumБесплатно доступноLaguna S 2.1mediumБесплатно доступноvsInkling SmallnoneБесплатно доступно