Навигация
AI BENCHY
Your ad here

AI BENCHY Compare

DeepSeek: DeepSeek V4 Flash vs Google: Gemini 3 Flash Preview

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-04-24

Метрика DeepSeek V4 Flash DeepSeek V4 Flash high Релиз: 2026-04-24 Gemini 3 Flash Preview Gemini 3 Flash Preview medium Релиз: 2025-12-17
Оценка 7.8 10.0
Ранг #35 #1
Стабильность 7.8 10.0
Тестов верно
Доля успешных попыток 79.6% 100.0%
Нестабильные тесты 5 0
Всего запусков 52 18
Стоимость за результат 0.189 0.600
Общая стоимость $0.021 $0.108
???? ????? $0.140 / 1M $0.500 / 1M
???? ?????? $0.280 / 1M $3.000 / 1M
Выходные токены 1,757 655
Токены рассуждений 55,907 33,749
Время ответа (среднее) 47.47s 12.11s
Время ответа (макс.) 255.28s 82.37s
Время ответа (суммарно) 854.45s 217.93s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
DeepSeek V4 Flash 8.3 10.0 75.0% 0 28.51s 140 7,770
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 3.26s 110 1,076
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
DeepSeek V4 Flash 10.0 10.0 100.0% 0 62.48s 369 9,361
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 82.37s 144 16,257
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
DeepSeek V4 Flash 10.0 10.0 100.0% 0 76.57s 465 7,347
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 23.58s 117 3,495
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
DeepSeek V4 Flash 10.0 10.0 100.0% 0 28.03s 201 1,179
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 7.62s 93 2,197
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
DeepSeek V4 Flash 4.1 4.4 44.5% 2 112.69s 19 24,857
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 14.81s 4 7,228
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
DeepSeek V4 Flash 6.1 3.1 66.7% 1 25.15s 79 632
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 6.34s 24 635
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
DeepSeek V4 Flash 10.0 10.0 100.0% 0 15.36s 63 1,622
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.30s 24 903
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
DeepSeek V4 Flash 6.4 4.5 77.8% 2 25.53s 193 2,597
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.86s 61 1,455
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
DeepSeek V4 Flash 10.0 10.0 100.0% 0 74.73s 228 542
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 9.78s 78 503

Быстрое сравнение

Сменить пару сравнения