Навигация
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 3 Flash Preview vs Qwen: Qwen3.6 Plus

Сводка

Сравнение benchmark Gemini 3 Flash Preview vs Qwen3.6 Plus: Gemini 3 Flash Preview лидирует по среднему баллу: 9.6 vs 7.8. Qwen3.6 Plus имеет более низкую стоимость benchmark: $0.294 vs $0.667. Gemini 3 Flash Preview быстрее: 18.64s vs 30.70s, с долей успешных попыток 98.4% vs 69.8%.

Рекомендуемая модель: Gemini 3 Flash Preview - Здесь у него лучший балл (9.6), и он отвечает примерно в 1.6 раза быстрее, чем Qwen3.6 Plus.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-07-02

Метрика Gemini 3 Flash Preview Gemini 3 Flash Preview medium Релиз: 2025-12-17 Qwen3.6 Plus Qwen3.6 Plus medium Релиз: 2026-04-20
Оценка 9.6 7.8
Ранг #2 #31
Надежность 10.0 10.0
Стабильность 9.7 9.3
Тестов верно
Доля успешных попыток 98.4% 69.8%
Нестабильные тесты 1 2
Всего запусков 63 63
Стоимость за результат 3.335 0.831
Общая стоимость $0.667 $0.294
Цена входа $0.500 / 1M $0.325 / 1M
Цена выхода $3.000 / 1M $1.950 / 1M
Общее число входных токенов 37,017 41,565
Выходные токены 2,006 1,853
Токены рассуждений 214,153 141,973
Время ответа (среднее) 18.64s 30.70s
Время ответа (макс.) 117.26s 201.68s
Время ответа (суммарно) 391.35s 613.99s

Генерация showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#2 Gemini 3 Flash Preview

medium
Стоимость
$0.010
Время
17.9s
Токены
3,236 tok

#31 Qwen3.6 Plus

medium
Стоимость
$0.024
Время
219.0s
Токены
12,235 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 3.88s 494 330 3,216
Qwen3.6 Plus 10.0 10.0 100.0% 0 9.90s 672 207 7,557
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3 Flash Preview 8.6 7.6 88.9% 1 84.40s 8,122 462 161,084
Qwen3.6 Plus 6.1 7.8 44.4% 1 153.12s 7,098 58 50,586
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 22.42s 12,873 351 10,485
Qwen3.6 Plus 10.0 10.0 100.0% 0 34.95s 14,934 452 13,073
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 5.43s 7,548 279 4,893
Qwen3.6 Plus 10.0 10.0 100.0% 0 14.95s 7,782 270 10,706
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 15.27s 633 12 21,684
Qwen3.6 Plus 2.9 7.2 11.1% 1 29.59s 771 56 33,464
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 5.19s 486 72 1,905
Qwen3.6 Plus 5.1 10.0 0.0% 0 27.05s 516 111 5,232
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.04s 615 72 2,709
Qwen3.6 Plus 10.0 10.0 100.0% 0 7.54s 699 102 5,552
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.05s 558 183 4,365
Qwen3.6 Plus 10.0 10.0 100.0% 0 6.34s 696 309 6,712
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 12.60s 5,532 234 1,487
Qwen3.6 Plus 10.0 10.0 100.0% 0 5.87s 8,193 267 1,330
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 5.50s 156 11 2,325
Qwen3.6 Plus 3.0 10.0 0.0% 0 47.51s 204 21 7,761

Быстрое сравнение

Сменить пару сравнения