Навигация
AI BENCHY
Advertise here

AI BENCHY Compare

ByteDance Seed: Seed-2.0-Lite vs Google: Gemini 3.5 Flash

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-05-19

Метрика Seed-2.0-Lite Seed-2.0-Lite medium Релиз: 2026-02-14 Gemini 3.5 Flash Gemini 3.5 Flash none Релиз: 2026-05-19
Оценка 8.3 9.1
Ранг #15 #6
Надежность 10.0 10.0
Стабильность 8.9 9.0
Тестов верно
Доля успешных попыток 79.0% 91.7%
Нестабильные тесты 3 2
Всего запусков 57 57
Стоимость за результат 0.958 3.490
Общая стоимость $0.125 $0.489
???? ????? $0.250 / 1M $1.500 / 1M
???? ?????? $2.000 / 1M $9.000 / 1M
Выходные токены 3,266 53,202
Токены рассуждений 54,082 0
Время ответа (среднее) 31.32s 5.59s
Время ответа (макс.) 168.71s 14.88s
Время ответа (суммарно) 595.04s 89.50s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Seed-2.0-Lite 8.3 10.0 75.0% 0 17.99s 996 7,142
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.53s 5,101 0
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Seed-2.0-Lite 10.0 10.0 100.0% 0 74.49s 436 7,319
Gemini 3.5 Flash 10.0 10.0 100.0% 0 14.88s 11,611 0
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Seed-2.0-Lite 10.0 10.0 100.0% 0 37.67s 506 4,299
Gemini 3.5 Flash 0.0 0.0 0.0% 0 0ms 0 0
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Seed-2.0-Lite 10.0 10.0 100.0% 0 9.07s 246 1,742
Gemini 3.5 Flash 10.0 10.0 100.0% 0 8.10s 5,895 0
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Seed-2.0-Lite 5.9 7.2 55.6% 1 88.74s 15 23,897
Gemini 3.5 Flash 7.6 7.2 77.8% 1 10.64s 17,910 0
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Seed-2.0-Lite 6.7 3.6 66.7% 1 18.25s 304 1,620
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.46s 1,620 0
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Seed-2.0-Lite 10.0 10.0 100.0% 0 7.26s 71 1,480
Gemini 3.5 Flash 9.8 10.0 100.0% 0 3.38s 3,928 0
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Seed-2.0-Lite 9.0 7.9 88.9% 1 11.03s 461 3,532
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.13s 4,640 0
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Seed-2.0-Lite 10.0 10.0 100.0% 0 12.38s 222 1,011
Gemini 3.5 Flash 0.0 0.0 0.0% 0 0ms 0 0
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Seed-2.0-Lite 3.0 10.0 0.0% 0 48.32s 9 2,040
Gemini 3.5 Flash 2.8 1.6 33.3% 1 4.87s 2,497 0

Быстрое сравнение

Сменить пару сравнения