Навигация
AI BENCHY
Advertise here

AI BENCHY Compare

DeepSeek: DeepSeek V4 Flash vs Qwen: Qwen3.7 Max

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-06-04

Метрика DeepSeek V4 Flash DeepSeek V4 Flash high Релиз: 2026-04-24 Qwen3.7 Max Qwen3.7 Max none Релиз: 2026-05-22
Оценка 7.7 7.7
Ранг #31 #34
Надежность 10.0 10.0
Стабильность 8.5 10.0
Тестов верно
Доля успешных попыток 74.6% 66.7%
Нестабильные тесты 4 0
Всего запусков 63 63
Стоимость за результат 0.299 0.744
Общая стоимость $0.029 $0.054
Цена входа $0.099 / 1M $1.250 / 1M
Цена выхода $0.197 / 1M $3.750 / 1M
Общее число входных токенов 39,745 37,107
Выходные токены 10,310 1,994
Токены рассуждений 123,501 0
Время ответа (среднее) 45.85s 1.30s
Время ответа (макс.) 218.13s 3.92s
Время ответа (суммарно) 962.79s 27.21s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
DeepSeek V4 Flash 8.3 10.0 75.0% 0 28.51s 540 140 7,770
Qwen3.7 Max 6.5 10.0 50.0% 0 1.08s 696 242 0
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
DeepSeek V4 Flash 7.8 10.0 66.7% 0 50.60s 7,279 395 34,862
Qwen3.7 Max 5.5 10.0 33.3% 0 1.35s 7,911 582 0
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
DeepSeek V4 Flash 10.0 10.0 100.0% 0 76.57s 14,016 465 7,347
Qwen3.7 Max 3.0 10.0 0.0% 0 2.17s 9,549 171 0
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
DeepSeek V4 Flash 10.0 10.0 100.0% 0 28.03s 7,290 201 1,179
Qwen3.7 Max 10.0 10.0 100.0% 0 1.35s 7,794 243 0
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
DeepSeek V4 Flash 4.1 4.4 44.5% 2 100.31s 666 27 59,249
Qwen3.7 Max 7.7 10.0 66.7% 0 975ms 789 15 0
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
DeepSeek V4 Flash 6.1 3.1 66.7% 1 25.15s 471 79 632
Qwen3.7 Max 10.0 10.0 100.0% 0 1.04s 522 120 0
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
DeepSeek V4 Flash 10.0 10.0 100.0% 0 15.36s 627 63 1,622
Qwen3.7 Max 10.0 10.0 100.0% 0 943ms 711 72 0
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
DeepSeek V4 Flash 8.2 7.2 88.9% 1 26.11s 594 196 1,767
Qwen3.7 Max 10.0 10.0 100.0% 0 1.13s 714 314 0
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
DeepSeek V4 Flash 10.0 10.0 100.0% 0 74.73s 8,079 228 542
Qwen3.7 Max 10.0 10.0 100.0% 0 3.92s 8,211 222 0
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
DeepSeek V4 Flash 3.0 10.0 0.0% 0 54.46s 183 8,516 8,531
Qwen3.7 Max 3.0 10.0 0.0% 0 856ms 210 13 0

Быстрое сравнение

Сменить пару сравнения