Навигация
AI BENCHY
Advertise here

Poolside: Laguna S 2.1 vs Qwen: Qwen3.6 35B A3B

Средний балл практически равен: 5.4 vs 5.3. Qwen3.6 35B A3B имеет более низкую стоимость benchmark: $0.061 vs $0.127. Qwen3.6 35B A3B быстрее: 5.52s vs 111.61s, с долей успешных попыток 27.3% vs 31.8%.

Рекомендуемая модельQwen3.6 35B A3BЗдесь у него лучший балл (5.3), при этом он примерно в 2.1 раза дешевле, чем Laguna S 2.1 (high).

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-07-22

Метрика Laguna S 2.1 Laguna S 2.1 high Релиз: 2026-07-21 Бесплатно доступно Qwen3.6 35B A3B Qwen3.6 35B A3B none Релиз: 2026-04-20
Оценка 5.4 5.3
Ранг #167 #169
Надежность 9.9 10.0
Стабильность 8.1 7.7
Тестов верно
Доля успешных попыток 27.3% 31.8%
Нестабильные тесты 5 6
Всего запусков 66 66
Стоимость за результат 3.153 1.496
Общая стоимость $0.127 $0.061
Цена входа $0.100 / 1M $0.140 / 1M
Цена выхода $0.200 / 1M $1.000 / 1M
Общее число входных токенов 208,931 93,979
Выходные токены 175,588 46,957
Токены рассуждений 409,276 0
Время ответа (среднее) 111.61s 5.52s
Время ответа (макс.) 1190.11s 39.54s
Время ответа (суммарно) 2455.39s 110.40s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#167 Laguna S 2.1

high
Стоимость
$0.001
Время
6.8s
Токены
1,389 tok

#169 Qwen3.6 35B A3B

none
Стоимость
$0.008
Время
30.1s
Токены
6,317 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Laguna S 2.1 5.3 7.2 44.4% 1 271.42s 6,496 59,355 151,009
Qwen3.6 35B A3B 5.5 10.0 33.3% 0 8.77s 7,911 11,161 0

Быстрое сравнение

Сменить пару сравнения