Навигация
AI BENCHY
Advertise here

Google: Gemini 3.5 Flash-Lite vs Meituan: LongCat 2.0

Gemini 3.5 Flash-Lite (medium) лидирует по среднему баллу: 6.5 vs 6.3. LongCat 2.0 имеет более низкую стоимость benchmark: $0.044 vs $0.369. LongCat 2.0 быстрее: 5.18s vs 6.01s, с долей успешных попыток 69.7% vs 36.4%.

Рекомендуемая модельLongCat 2.0Его балл близок к лучшему здесь (6.3 против 6.5), при этом он примерно в 8.4 раза дешевле, чем Gemini 3.5 Flash-Lite (medium).

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-07-21

Метрика Gemini 3.5 Flash-Lite Gemini 3.5 Flash-Lite medium Релиз: 2026-07-21 LongCat 2.0 LongCat 2.0 none Релиз: 2026-07-20
Оценка 6.5 6.3
Ранг #104 #117
Надежность 10.0 10.0
Стабильность 7.4 9.3
Тестов верно
Доля успешных попыток 69.7% 36.4%
Нестабильные тесты 7 2
Всего запусков 66 66
Стоимость за результат 3.074 0.627
Общая стоимость $0.369 $0.044
Цена входа $0.300 / 1M $0.300 / 1M
Цена выхода $2.500 / 1M $1.200 / 1M
Общее число входных токенов 118,818 108,743
Выходные токены 11,677 9,372
Токены рассуждений 121,611 0
Время ответа (среднее) 6.01s 5.18s
Время ответа (макс.) 49.03s 48.38s
Время ответа (суммарно) 132.30s 113.95s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#104 Gemini 3.5 Flash-Lite

medium
Стоимость
$0.015
Время
16.4s
Токены
5,971 tok

#117 LongCat 2.0

none
Стоимость
$0.027
Время
411.7s
Токены
22,283 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.5 Flash-Lite 5.5 7.4 44.4% 1 8.37s 8,136 452 25,999
LongCat 2.0 5.5 10.0 33.3% 0 2.85s 7,446 578 0

Быстрое сравнение

Сменить пару сравнения