Навигация
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Google: Gemma 4 31B vs Meituan: LongCat 2.0

Средний балл практически равен: 6.3 vs 6.3. LongCat 2.0 имеет более низкую стоимость benchmark: $0.044 vs $0.163. LongCat 2.0 быстрее: 5.18s vs 75.38s, с долей успешных попыток 68.2% vs 36.4%.

Рекомендуемая модельLongCat 2.0Здесь у него лучший балл (6.3), при этом он примерно в 3.7 раза дешевле, чем Gemma 4 31B (medium).

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-07-20

Метрика Gemma 4 31B Gemma 4 31B medium Релиз: 2026-04-02 Бесплатно доступно LongCat 2.0 LongCat 2.0 none Релиз: 2026-07-20
Оценка 6.3 6.3
Ранг #110 #111
Надежность 10.0 10.0
Стабильность 9.0 9.3
Тестов верно
Доля успешных попыток 68.2% 36.4%
Нестабильные тесты 2 2
Всего запусков 66 66
Стоимость за результат 1.044 0.627
Общая стоимость $0.163 $0.044
Цена входа $0.220 / 1M $0.300 / 1M
Цена выхода $0.550 / 1M $1.200 / 1M
Общее число входных токенов 94,992 108,743
Выходные токены 34,468 9,372
Токены рассуждений 223,278 0
Время ответа (среднее) 75.38s 5.18s
Время ответа (макс.) 437.40s 48.38s
Время ответа (суммарно) 1507.52s 113.95s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#110 Gemma 4 31B

medium
Стоимость
$0.002
Время
45.7s
Токены
2,696 tok

#111 LongCat 2.0

none
Стоимость
$0.027
Время
411.7s
Токены
22,283 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemma 4 31B 4.3 5.8 22.2% 1 219.76s 5,568 11,098 33,212
LongCat 2.0 5.5 10.0 33.3% 0 2.85s 7,446 578 0

Быстрое сравнение

Сменить пару сравнения