Google: Gemini 3 Flash Preview vs Qwen3.6 Plus Preview
Сводка
Сравнение benchmark Gemini 3 Flash Preview vs Qwen3.6 Plus Preview: Gemini 3 Flash Preview лидирует по среднему баллу: 9.6 vs 5.8. Qwen3.6 Plus Preview имеет более низкую стоимость benchmark: $0.000 vs $0.667. Qwen3.6 Plus Preview быстрее: 15.25s vs 18.64s, с долей успешных попыток 98.4% vs 42.9%.
Рекомендуемая модель: Gemini 3 Flash Preview - У него самый высокий балл в этом сравнении (9.6) и лучший общий баланс стоимости и времени ответа среди всех 2 моделей.
Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-06-18
Qwen3.6 Plus PreviewQwen3.6 Plus PreviewmediumАрхивная модель: эта модель больше не обновляется и не тестируется на новых тестах.Релиз: 2026-04-20Бесплатно доступно
Qwen3.6 Plus PreviewQwen3.6 Plus PreviewmediumАрхивная модель: эта модель больше не обновляется и не тестируется на новых тестах.Релиз: 2026-04-20Бесплатно доступно
Оценка
9.6Средний балл по всем бенчмарк-тестам.…
5.8Средний балл по всем бенчмарк-тестам.…
Ранг
#2
#113
Надежность
10.0Оценка успеха с первой попытки: 10.0 означает отсутствие повторяемых сбоев целевого API или лимитов до успешных вызовов; зафиксированные сбои снижают оценку.…
Н/ДОценка успеха с первой попытки: 10.0 означает отсутствие повторяемых сбоев целевого API или лимитов до успешных вызовов; зафиксированные сбои снижают оценку.…
Стабильность
9.7Оценка стабильности отражает устойчивость между прогонами (10 = очень стабильно, даже если стабильно неверно).…
9.0Оценка стабильности отражает устойчивость между прогонами (10 = очень стабильно, даже если стабильно неверно).…
Тестов верно
Тест считается полностью пройденным, только если все его прогоны успешны.Неверный ответ: 1Время ответа (среднее)18.64sВремя ответа (макс.)117.26sВремя ответа (суммарно)391.35sТест считается полностью пройденным, только если все его прогоны успешны.…
Тест считается полностью пройденным, только если все его прогоны успешны.Ошибка API: 8Неверный ответ: 2Время ответа (среднее)15.25sВремя ответа (макс.)43.55sВремя ответа (суммарно)182.96sТест считается полностью пройденным, только если все его прогоны успешны.…
Доля успешных попыток
98.4%Доля успешных попыток = успешные попытки / все попытки по всем прогонам.…
42.9%Доля успешных попыток = успешные попытки / все попытки по всем прогонам.…
Нестабильные тесты
1Нестабильные тесты имели смешанные результаты между прогонами (как минимум один успех и один провал).…
0Нестабильные тесты имели смешанные результаты между прогонами (как минимум один успех и один провал).…
Всего запусков
63Всего запусков…
57Всего запусков…
Стоимость за результат
3.335Показывает среднюю стоимость одного правильного ответа в бенчмарке в центах (меньше — лучше).…
0.000Показывает среднюю стоимость одного правильного ответа в бенчмарке в центах (меньше — лучше).…
Общая стоимость
$0.667Общая стоимость (текущая цена)…
$0.000Общая стоимость (текущая цена)…
Цена входа
$0.500 / 1MЦена входа…
$0.000 / 1MЦена входа…
Цена выхода
$3.000 / 1MЦена выхода…
$0.000 / 1MЦена выхода…
Общее число входных токенов
37,017Общее число входных токенов…
32,639Общее число входных токенов…
Выходные токены
2,006Выходные токены…
1,153Выходные токены…
Токены рассуждений
214,153Токены рассуждений…
62,197Токены рассуждений…
Время ответа (среднее)
18.64sВремя ответа (среднее)…
15.25sВремя ответа (среднее)…
Время ответа (макс.)
117.26sВремя ответа (макс.)…
43.55sВремя ответа (макс.)…
Время ответа (суммарно)
391.35sВремя ответа (суммарно)…
182.96sВремя ответа (суммарно)…
Генерация showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#2 Gemini 3 Flash Preview
medium
Стоимость
$0.010
Время
17.9s
Токены
3,236 tok
#113 Qwen3.6 Plus Preview
medium
Для этой модели еще не сгенерирован результат showcase.
10.0Оценка стабильности отражает устойчивость между прогонами (10 = очень стабильно, даже если стабильно неверно).…
100.0%Доля успешных попыток = успешные попытки / все попытки по всем прогонам.…
0Нестабильные тесты имели смешанные результаты между прогонами (как минимум один успех и один провал).…
Тест считается полностью пройденным, только если все его прогоны успешны.Нет проваленных ответов.Время ответа (среднее)3.88sВремя ответа (макс.)5.73sВремя ответа (суммарно)15.53sТест считается полностью пройденным, только если все его прогоны успешны.…
3.88sВремя ответа (среднее)…
494Общее число входных токенов…
330Выходные токены…
3,216Токены рассуждений…
Qwen3.6 Plus PreviewАрхивная модель: эта модель больше не обновляется и не тестируется на новых тестах.
8.3Средний балл по всем бенчмарк-тестам.…
10.0Оценка стабильности отражает устойчивость между прогонами (10 = очень стабильно, даже если стабильно неверно).…
75.0%Доля успешных попыток = успешные попытки / все попытки по всем прогонам.…
0Нестабильные тесты имели смешанные результаты между прогонами (как минимум один успех и один провал).…
Тест считается полностью пройденным, только если все его прогоны успешны.Ошибка API: 1Время ответа (среднее)11.69sВремя ответа (макс.)19.37sВремя ответа (суммарно)35.08sТест считается полностью пройденным, только если все его прогоны успешны.…
7.6Оценка стабильности отражает устойчивость между прогонами (10 = очень стабильно, даже если стабильно неверно).…
88.9%Доля успешных попыток = успешные попытки / все попытки по всем прогонам.…
1Нестабильные тесты имели смешанные результаты между прогонами (как минимум один успех и один провал).…
Тест считается полностью пройденным, только если все его прогоны успешны.Неверный ответ: 1Время ответа (среднее)84.40sВремя ответа (макс.)117.26sВремя ответа (суммарно)253.21sТест считается полностью пройденным, только если все его прогоны успешны.…
84.40sВремя ответа (среднее)…
8,122Общее число входных токенов…
462Выходные токены…
161,084Токены рассуждений…
Qwen3.6 Plus PreviewАрхивная модель: эта модель больше не обновляется и не тестируется на новых тестах.
9.8Средний балл по всем бенчмарк-тестам.…
3.3Оценка стабильности отражает устойчивость между прогонами (10 = очень стабильно, даже если стабильно неверно).…
0.0%Доля успешных попыток = успешные попытки / все попытки по всем прогонам.…
0Нестабильные тесты имели смешанные результаты между прогонами (как минимум один успех и один провал).…
Тест считается полностью пройденным, только если все его прогоны успешны.Ошибка API: 1Время ответа (среднее)0msВремя ответа (макс.)0msВремя ответа (суммарно)0msТест считается полностью пройденным, только если все его прогоны успешны.…
10.0Оценка стабильности отражает устойчивость между прогонами (10 = очень стабильно, даже если стабильно неверно).…
100.0%Доля успешных попыток = успешные попытки / все попытки по всем прогонам.…
0Нестабильные тесты имели смешанные результаты между прогонами (как минимум один успех и один провал).…
Тест считается полностью пройденным, только если все его прогоны успешны.Нет проваленных ответов.Время ответа (среднее)22.42sВремя ответа (макс.)22.42sВремя ответа (суммарно)22.42sТест считается полностью пройденным, только если все его прогоны успешны.…
22.42sВремя ответа (среднее)…
12,873Общее число входных токенов…
351Выходные токены…
10,485Токены рассуждений…
Qwen3.6 Plus PreviewАрхивная модель: эта модель больше не обновляется и не тестируется на новых тестах.
10.0Средний балл по всем бенчмарк-тестам.…
10.0Оценка стабильности отражает устойчивость между прогонами (10 = очень стабильно, даже если стабильно неверно).…
100.0%Доля успешных попыток = успешные попытки / все попытки по всем прогонам.…
0Нестабильные тесты имели смешанные результаты между прогонами (как минимум один успех и один провал).…
Тест считается полностью пройденным, только если все его прогоны успешны.Нет проваленных ответов.Время ответа (среднее)34.95sВремя ответа (макс.)34.95sВремя ответа (суммарно)34.95sТест считается полностью пройденным, только если все его прогоны успешны.…
10.0Оценка стабильности отражает устойчивость между прогонами (10 = очень стабильно, даже если стабильно неверно).…
100.0%Доля успешных попыток = успешные попытки / все попытки по всем прогонам.…
0Нестабильные тесты имели смешанные результаты между прогонами (как минимум один успех и один провал).…
Тест считается полностью пройденным, только если все его прогоны успешны.Нет проваленных ответов.Время ответа (среднее)5.43sВремя ответа (макс.)6.18sВремя ответа (суммарно)10.86sТест считается полностью пройденным, только если все его прогоны успешны.…
5.43sВремя ответа (среднее)…
7,548Общее число входных токенов…
279Выходные токены…
4,893Токены рассуждений…
Qwen3.6 Plus PreviewАрхивная модель: эта модель больше не обновляется и не тестируется на новых тестах.
10.0Средний балл по всем бенчмарк-тестам.…
10.0Оценка стабильности отражает устойчивость между прогонами (10 = очень стабильно, даже если стабильно неверно).…
100.0%Доля успешных попыток = успешные попытки / все попытки по всем прогонам.…
0Нестабильные тесты имели смешанные результаты между прогонами (как минимум один успех и один провал).…
Тест считается полностью пройденным, только если все его прогоны успешны.Нет проваленных ответов.Время ответа (среднее)14.95sВремя ответа (макс.)15.40sВремя ответа (суммарно)29.90sТест считается полностью пройденным, только если все его прогоны успешны.…
10.0Оценка стабильности отражает устойчивость между прогонами (10 = очень стабильно, даже если стабильно неверно).…
100.0%Доля успешных попыток = успешные попытки / все попытки по всем прогонам.…
0Нестабильные тесты имели смешанные результаты между прогонами (как минимум один успех и один провал).…
Тест считается полностью пройденным, только если все его прогоны успешны.Нет проваленных ответов.Время ответа (среднее)15.27sВремя ответа (макс.)34.09sВремя ответа (суммарно)45.80sТест считается полностью пройденным, только если все его прогоны успешны.…
15.27sВремя ответа (среднее)…
633Общее число входных токенов…
12Выходные токены…
21,684Токены рассуждений…
Qwen3.6 Plus PreviewАрхивная модель: эта модель больше не обновляется и не тестируется на новых тестах.
3.0Средний балл по всем бенчмарк-тестам.…
10.0Оценка стабильности отражает устойчивость между прогонами (10 = очень стабильно, даже если стабильно неверно).…
0.0%Доля успешных попыток = успешные попытки / все попытки по всем прогонам.…
0Нестабильные тесты имели смешанные результаты между прогонами (как минимум один успех и один провал).…
Тест считается полностью пройденным, только если все его прогоны успешны.Неверный ответ: 2Ошибка API: 1Время ответа (среднее)22.08sВремя ответа (макс.)43.55sВремя ответа (суммарно)66.23sТест считается полностью пройденным, только если все его прогоны успешны.…
10.0Оценка стабильности отражает устойчивость между прогонами (10 = очень стабильно, даже если стабильно неверно).…
100.0%Доля успешных попыток = успешные попытки / все попытки по всем прогонам.…
0Нестабильные тесты имели смешанные результаты между прогонами (как минимум один успех и один провал).…
Тест считается полностью пройденным, только если все его прогоны успешны.Нет проваленных ответов.Время ответа (среднее)5.19sВремя ответа (макс.)5.19sВремя ответа (суммарно)5.19sТест считается полностью пройденным, только если все его прогоны успешны.…
5.19sВремя ответа (среднее)…
486Общее число входных токенов…
72Выходные токены…
1,905Токены рассуждений…
Qwen3.6 Plus PreviewАрхивная модель: эта модель больше не обновляется и не тестируется на новых тестах.
3.0Средний балл по всем бенчмарк-тестам.…
10.0Оценка стабильности отражает устойчивость между прогонами (10 = очень стабильно, даже если стабильно неверно).…
0.0%Доля успешных попыток = успешные попытки / все попытки по всем прогонам.…
0Нестабильные тесты имели смешанные результаты между прогонами (как минимум один успех и один провал).…
Тест считается полностью пройденным, только если все его прогоны успешны.Ошибка API: 1Время ответа (среднее)0msВремя ответа (макс.)0msВремя ответа (суммарно)0msТест считается полностью пройденным, только если все его прогоны успешны.…
10.0Оценка стабильности отражает устойчивость между прогонами (10 = очень стабильно, даже если стабильно неверно).…
100.0%Доля успешных попыток = успешные попытки / все попытки по всем прогонам.…
0Нестабильные тесты имели смешанные результаты между прогонами (как минимум один успех и один провал).…
Тест считается полностью пройденным, только если все его прогоны успешны.Нет проваленных ответов.Время ответа (среднее)4.04sВремя ответа (макс.)4.70sВремя ответа (суммарно)8.08sТест считается полностью пройденным, только если все его прогоны успешны.…
4.04sВремя ответа (среднее)…
615Общее число входных токенов…
72Выходные токены…
2,709Токены рассуждений…
Qwen3.6 Plus PreviewАрхивная модель: эта модель больше не обновляется и не тестируется на новых тестах.
6.5Средний балл по всем бенчмарк-тестам.…
10.0Оценка стабильности отражает устойчивость между прогонами (10 = очень стабильно, даже если стабильно неверно).…
50.0%Доля успешных попыток = успешные попытки / все попытки по всем прогонам.…
0Нестабильные тесты имели смешанные результаты между прогонами (как минимум один успех и один провал).…
Тест считается полностью пройденным, только если все его прогоны успешны.Ошибка API: 1Время ответа (среднее)3.40sВремя ответа (макс.)3.40sВремя ответа (суммарно)3.40sТест считается полностью пройденным, только если все его прогоны успешны.…
10.0Оценка стабильности отражает устойчивость между прогонами (10 = очень стабильно, даже если стабильно неверно).…
100.0%Доля успешных попыток = успешные попытки / все попытки по всем прогонам.…
0Нестабильные тесты имели смешанные результаты между прогонами (как минимум один успех и один провал).…
Тест считается полностью пройденным, только если все его прогоны успешны.Нет проваленных ответов.Время ответа (среднее)4.05sВремя ответа (макс.)5.64sВремя ответа (суммарно)12.15sТест считается полностью пройденным, только если все его прогоны успешны.…
4.05sВремя ответа (среднее)…
558Общее число входных токенов…
183Выходные токены…
4,365Токены рассуждений…
Qwen3.6 Plus PreviewАрхивная модель: эта модель больше не обновляется и не тестируется на новых тестах.
5.3Средний балл по всем бенчмарк-тестам.…
10.0Оценка стабильности отражает устойчивость между прогонами (10 = очень стабильно, даже если стабильно неверно).…
33.3%Доля успешных попыток = успешные попытки / все попытки по всем прогонам.…
0Нестабильные тесты имели смешанные результаты между прогонами (как минимум один успех и один провал).…
Тест считается полностью пройденным, только если все его прогоны успешны.Ошибка API: 2Время ответа (среднее)7.52sВремя ответа (макс.)7.52sВремя ответа (суммарно)7.52sТест считается полностью пройденным, только если все его прогоны успешны.…
10.0Оценка стабильности отражает устойчивость между прогонами (10 = очень стабильно, даже если стабильно неверно).…
100.0%Доля успешных попыток = успешные попытки / все попытки по всем прогонам.…
0Нестабильные тесты имели смешанные результаты между прогонами (как минимум один успех и один провал).…
Тест считается полностью пройденным, только если все его прогоны успешны.Нет проваленных ответов.Время ответа (среднее)12.60sВремя ответа (макс.)12.60sВремя ответа (суммарно)12.60sТест считается полностью пройденным, только если все его прогоны успешны.…
12.60sВремя ответа (среднее)…
5,532Общее число входных токенов…
234Выходные токены…
1,487Токены рассуждений…
Qwen3.6 Plus PreviewАрхивная модель: эта модель больше не обновляется и не тестируется на новых тестах.
10.0Средний балл по всем бенчмарк-тестам.…
10.0Оценка стабильности отражает устойчивость между прогонами (10 = очень стабильно, даже если стабильно неверно).…
100.0%Доля успешных попыток = успешные попытки / все попытки по всем прогонам.…
0Нестабильные тесты имели смешанные результаты между прогонами (как минимум один успех и один провал).…
Тест считается полностью пройденным, только если все его прогоны успешны.Нет проваленных ответов.Время ответа (среднее)5.87sВремя ответа (макс.)5.87sВремя ответа (суммарно)5.87sТест считается полностью пройденным, только если все его прогоны успешны.…
10.0Оценка стабильности отражает устойчивость между прогонами (10 = очень стабильно, даже если стабильно неверно).…
100.0%Доля успешных попыток = успешные попытки / все попытки по всем прогонам.…
0Нестабильные тесты имели смешанные результаты между прогонами (как минимум один успех и один провал).…
Тест считается полностью пройденным, только если все его прогоны успешны.Нет проваленных ответов.Время ответа (среднее)5.50sВремя ответа (макс.)5.50sВремя ответа (суммарно)5.50sТест считается полностью пройденным, только если все его прогоны успешны.…
5.50sВремя ответа (среднее)…
156Общее число входных токенов…
11Выходные токены…
2,325Токены рассуждений…
Qwen3.6 Plus PreviewАрхивная модель: эта модель больше не обновляется и не тестируется на новых тестах.
3.0Средний балл по всем бенчмарк-тестам.…
10.0Оценка стабильности отражает устойчивость между прогонами (10 = очень стабильно, даже если стабильно неверно).…
0.0%Доля успешных попыток = успешные попытки / все попытки по всем прогонам.…
0Нестабильные тесты имели смешанные результаты между прогонами (как минимум один успех и один провал).…
Тест считается полностью пройденным, только если все его прогоны успешны.Ошибка API: 1Время ответа (среднее)0msВремя ответа (макс.)0msВремя ответа (суммарно)0msТест считается полностью пройденным, только если все его прогоны успешны.…