Навигация
AI BENCHY
Your ad here

AI BENCHY Compare

Elephant vs Qwen: Qwen3 Coder Next

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-04-14

Метрика Elephant Elephant medium Релиз: 2026-04-14 Qwen3 Coder Next Qwen3 Coder Next none Релиз: 2026-02-03
Оценка 5.2 5.1
Ранг #77 #83
Стабильность 9.6 9.7
Тестов верно
Доля успешных попыток 29.6% 25.9%
Нестабильные тесты 1 1
Всего запусков 54 54
Стоимость за результат 0.000 0.188
Общая стоимость $0.000 $0.008
???? ????? $0.000 / 1M $0.150 / 1M
???? ?????? $0.000 / 1M $0.800 / 1M
Выходные токены 2,596 3,617
Токены рассуждений 0 0
Время ответа (среднее) 1.27s 10.18s
Время ответа (макс.) 3.70s 45.14s
Время ответа (суммарно) 22.82s 122.13s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Elephant 6.6 10.0 50.0% 0 1.19s 815 0
Qwen3 Coder Next 3.6 10.0 0.0% 0 3.31s 1,321 0
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Elephant 5.1 3.3 33.3% 1 1.30s 365 0
Qwen3 Coder Next 7.3 3.7 66.7% 1 3.14s 585 0
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Elephant 3.0 10.0 0.0% 0 3.70s 562 0
Qwen3 Coder Next 3.0 10.0 0.0% 0 45.14s 317 0
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Elephant 6.5 10.0 50.0% 0 979ms 246 0
Qwen3 Coder Next 6.5 10.0 50.0% 0 1.32s 246 0
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Elephant 3.0 10.0 0.0% 0 925ms 24 0
Qwen3 Coder Next 5.3 10.0 33.3% 0 962ms 26 0
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Elephant 4.3 10.0 0.0% 0 920ms 105 0
Qwen3 Coder Next 10.0 10.0 100.0% 0 1.34s 152 0
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Elephant 9.8 10.0 100.0% 0 987ms 82 0
Qwen3 Coder Next 4.8 10.0 0.0% 0 7.71s 63 0
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Elephant 3.7 10.0 0.0% 0 867ms 166 0
Qwen3 Coder Next 3.2 10.0 0.0% 0 22.86s 652 0
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Elephant 3.0 10.0 0.0% 0 2.83s 231 0
Qwen3 Coder Next 10.0 10.0 100.0% 0 2.47s 255 0

Быстрое сравнение

Сменить пару сравнения