Навигация
AI BENCHY
Advertise here

Poolside: Laguna S 2.1 vs Qwen: Qwen3 Coder Next

Laguna S 2.1 (medium) лидирует по среднему баллу: 5.4 vs 5.1. Qwen3 Coder Next имеет более низкую стоимость benchmark: $0.025 vs $0.059. Qwen3 Coder Next быстрее: 9.12s vs 58.43s, с долей успешных попыток 25.8% vs 25.8%.

Рекомендуемая модельQwen3 Coder NextЕго балл близок к лучшему здесь (5.1 против 5.4), при этом он примерно в 2.4 раза дешевле, чем Laguna S 2.1 (medium).

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-07-22

Метрика Laguna S 2.1 Laguna S 2.1 medium Релиз: 2026-07-21 Бесплатно доступно Qwen3 Coder Next Qwen3 Coder Next none Релиз: 2026-02-03
Оценка 5.4 5.1
Ранг #164 #174
Надежность 9.8 10.0
Стабильность 8.4 9.7
Тестов верно
Доля успешных попыток 25.8% 25.8%
Нестабильные тесты 4 1
Всего запусков 66 66
Стоимость за результат 1.451 0.488
Общая стоимость $0.059 $0.025
Цена входа $0.100 / 1M $0.110 / 1M
Цена выхода $0.200 / 1M $0.800 / 1M
Общее число входных токенов 86,641 134,218
Выходные токены 97,298 11,808
Токены рассуждений 242,297 0
Время ответа (среднее) 58.43s 9.12s
Время ответа (макс.) 560.31s 45.14s
Время ответа (суммарно) 1285.48s 145.94s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#164 Laguna S 2.1

medium
Стоимость
$0.001
Время
4.0s
Токены
867 tok

#174 Qwen3 Coder Next

none
Неверный SVG
Стоимость
$0.058
Время
246.3s
Токены
64,126 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Laguna S 2.1 5.3 7.2 44.4% 1 158.98s 7,917 93,354 106,718
Qwen3 Coder Next 4.6 7.9 22.2% 1 2.22s 7,442 621 0

Быстрое сравнение

Сменить пару сравнения