Навигация
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Poolside: Laguna S 2.1 vs Qwen: Qwen3.5-9B

Laguna S 2.1 (medium) лидирует по среднему баллу: 5.4 vs 5.1. Qwen3.5-9B имеет более низкую стоимость benchmark: $0.021 vs $0.059. Qwen3.5-9B быстрее: 19.17s vs 58.43s, с долей успешных попыток 25.8% vs 19.7%.

Рекомендуемая модельQwen3.5-9BЕго балл близок к лучшему здесь (5.1 против 5.4), при этом он примерно в 2.9 раза дешевле, чем Laguna S 2.1 (medium).

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-07-22

Метрика Laguna S 2.1 Laguna S 2.1 medium Релиз: 2026-07-21 Бесплатно доступно Qwen3.5-9B Qwen3.5-9B none Релиз: 2026-03-02
Оценка 5.4 5.1
Ранг #164 #177
Надежность 9.8 10.0
Стабильность 8.4 9.7
Тестов верно
Доля успешных попыток 25.8% 19.7%
Нестабильные тесты 4 1
Всего запусков 66 66
Стоимость за результат 1.451 0.490
Общая стоимость $0.059 $0.021
Цена входа $0.100 / 1M $0.100 / 1M
Цена выхода $0.200 / 1M $0.150 / 1M
Общее число входных токенов 86,641 144,407
Выходные токены 97,298 37,484
Токены рассуждений 242,297 0
Время ответа (среднее) 58.43s 19.17s
Время ответа (макс.) 560.31s 382.06s
Время ответа (суммарно) 1285.48s 421.74s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#164 Laguna S 2.1

medium
Стоимость
$0.001
Время
4.0s
Токены
867 tok

#177 Qwen3.5-9B

none
Неверный SVG
Стоимость
$0.000
Время
300.0s
Токены
0 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Laguna S 2.1 5.3 7.2 44.4% 1 158.98s 7,917 93,354 106,718
Qwen3.5-9B 3.9 7.8 11.1% 1 5.60s 7,913 1,042 0

Быстрое сравнение

Сменить пару сравнения