Навигация
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Laguna S 2.1 vs Grok 4.20

Laguna S 2.1 лидирует по среднему баллу: 4.5 vs 4.1. Laguna S 2.1 имеет более низкую стоимость benchmark: $0.022 vs $0.057. Grok 4.20 быстрее: 1.11s vs 11.67s, с долей успешных попыток 15.2% vs 27.3%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-09-04

Ранг
#290
Общее число выходных токенов
57,634
Время ответа (среднее)
11.67s
Общая стоимость
$0.022
Ранг
#298
Общее число выходных токенов
1,923
Время ответа (среднее)
1.11s
Общая стоимость
$0.057
Рекомендуемая модель Laguna S 2.1

Здесь у него лучший балл (4.5), при этом он примерно в 2.6 раза дешевле, чем Grok 4.20.

Подробное сравнение

Метрика Laguna S 2.1 Laguna S 2.1 none Релиз: 2026-07-21 Бесплатно доступно Grok 4.20 Grok 4.20 none Релиз: 2026-03-31
Оценка 4.5 4.1
Ранг #290 #298
Надежность 10.0 Н/Д
Стабильность 8.8 8.1
Попытки 66/66 54/66
Тестов верно
Доля успешных попыток 15.2% 27.3%
Нестабильные тесты 3 0
Всего запусков 66 54
Стоимость за результат 1.205 1.570
Общая стоимость $0.022 $0.057
Цена входа $0.090 / 1M $1.250 / 1M
Цена выхода $0.180 / 1M $2.500 / 1M
Общее число входных токенов 125,604 41,313
Выходные токены 57,634 1,923
Токены рассуждений 0 0
Время ответа (среднее) 11.67s 1.11s
Время ответа (макс.) 200.52s 6.04s
Время ответа (суммарно) 256.71s 19.96s
Параметры 118B всего (8B активных) ~1T всего (~100B активных)
Доступность Веса доступны Закрытая модель

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#290 Laguna S 2.1

none
Стоимость
$0.001
Время
7.6s
Токены
1,345 tok

#298 xAI: Grok 4.20

none
Стоимость
$0.004
Время
6.5s
Токены
1,367 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Laguna S 2.1 3.4 9.7 0.0% 0 550ms 7,917 424 0
Grok 4.20 1.1 3.1 0.0% 0 1.22s 1,074 312 0

Быстрое сравнение

Сменить пару сравнения