Навигация
AI BENCHY
Advertise here

Poolside: Laguna S 2.1 vs Qwen: Qwen3.5-9B

Laguna S 2.1 (high) лидирует по среднему баллу: 5.4 vs 5.1. Qwen3.5-9B имеет более низкую стоимость benchmark: $0.021 vs $0.127. Qwen3.5-9B быстрее: 19.17s vs 111.61s, с долей успешных попыток 27.3% vs 19.7%.

Рекомендуемая модельQwen3.5-9BЕго балл близок к лучшему здесь (5.1 против 5.4), при этом он примерно в 6.3 раза дешевле, чем Laguna S 2.1 (high).

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-07-22

Метрика Laguna S 2.1 Laguna S 2.1 high Релиз: 2026-07-21 Бесплатно доступно Qwen3.5-9B Qwen3.5-9B none Релиз: 2026-03-02
Оценка 5.4 5.1
Ранг #167 #177
Надежность 9.9 10.0
Стабильность 8.1 9.7
Тестов верно
Доля успешных попыток 27.3% 19.7%
Нестабильные тесты 5 1
Всего запусков 66 66
Стоимость за результат 3.153 0.490
Общая стоимость $0.127 $0.021
Цена входа $0.100 / 1M $0.100 / 1M
Цена выхода $0.200 / 1M $0.150 / 1M
Общее число входных токенов 208,931 144,407
Выходные токены 175,588 37,484
Токены рассуждений 409,276 0
Время ответа (среднее) 111.61s 19.17s
Время ответа (макс.) 1190.11s 382.06s
Время ответа (суммарно) 2455.39s 421.74s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#167 Laguna S 2.1

high
Стоимость
$0.001
Время
6.8s
Токены
1,389 tok

#177 Qwen3.5-9B

none
Неверный SVG
Стоимость
$0.000
Время
300.0s
Токены
0 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Laguna S 2.1 5.3 7.2 44.4% 1 271.42s 6,496 59,355 151,009
Qwen3.5-9B 3.9 7.8 11.1% 1 5.60s 7,913 1,042 0

Быстрое сравнение

Сменить пару сравнения