Навигация
AI BENCHY
Your ad here

AI BENCHY Compare

Google: Gemini 3 Flash Preview vs Qwen: Qwen3.5-122B-A10B

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-04-14

Метрика Gemini 3 Flash Preview Gemini 3 Flash Preview medium Релиз: 2025-12-17 Qwen3.5-122B-A10B Qwen3.5-122B-A10B none Релиз: 2026-02-24
Оценка 10.0 5.7
Ранг #1 #66
Стабильность 10.0 9.2
Тестов верно
Доля успешных попыток 100.0% 38.9%
Нестабильные тесты 0 2
Всего запусков 54 54
Стоимость за результат 1.740 0.360
Общая стоимость $0.314 $0.022
???? ????? $0.500 / 1M $0.260 / 1M
???? ?????? $3.000 / 1M $2.080 / 1M
Выходные токены 2,072 3,341
Токены рассуждений 97,041 0
Время ответа (среднее) 17.60s 3.69s
Время ответа (макс.) 79.71s 46.00s
Время ответа (суммарно) 193.57s 66.50s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.13s 305 3,490
Qwen3.5-122B-A10B 4.8 10.0 25.0% 0 1.59s 312 0
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 79.71s 432 48,771
Qwen3.5-122B-A10B 4.3 1.1 66.7% 1 3.44s 659 0
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 50.16s 351 12,645
Qwen3.5-122B-A10B 3.0 10.0 0.0% 0 46.00s 1,137 0
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.72s 279 5,333
Qwen3.5-122B-A10B 10.0 10.0 100.0% 0 1.01s 243 0
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 21.12s 12 14,908
Qwen3.5-122B-A10B 5.3 10.0 33.3% 0 465ms 15 0
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.09s 111 1,285
Qwen3.5-122B-A10B 5.0 10.0 0.0% 0 1.12s 66 0
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 6.10s 72 4,558
Qwen3.5-122B-A10B 4.5 6.8 16.7% 1 585ms 70 0
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.43s 276 4,921
Qwen3.5-122B-A10B 5.4 10.0 33.3% 0 982ms 575 0
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 10.55s 234 1,130
Qwen3.5-122B-A10B 10.0 10.0 100.0% 0 2.04s 264 0

Быстрое сравнение

Сменить пару сравнения