Навигация
AI BENCHY
Your ad here

AI BENCHY Compare

ByteDance Seed: Seed-2.0-Lite vs Google: Gemini 3 Pro Preview

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-03-15

Метрика Seed-2.0-Lite Seed-2.0-Lite medium Релиз: 2026-02-14 Gemini 3 Pro Preview Gemini 3 Pro Preview medium Релиз: 2025-11-18
Ранг #3 #7
Оценка 8.8 8.6
Стабильность 8.7 10.0
Стоимость за результат 0.870 1.477
Общая стоимость $0.105 $0.192
Тестов верно
Доля успешных попыток 87.5% 81.3%
Нестабильные тесты 3 0
Всего запусков 48 48
Выходные токены 2,815 1,502
Токены рассуждений 44,618 9,706
Время ответа (среднее) 29.39s 7.15s
Время ответа (макс.) 168.71s 11.96s
Время ответа (суммарно) 470.29s 64.34s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Seed-2.0-Lite 10.0 10.0 100.0% 0 23.34s 990 7,037
Gemini 3 Pro Preview 10.0 10.0 100.0% 0 3.75s 143 1,107
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Seed-2.0-Lite 10.0 10.0 100.0% 0 37.67s 506 4,299
Gemini 3 Pro Preview 3.0 10.0 0.0% 0 10.37s 351 952
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Seed-2.0-Lite 10.0 10.0 100.0% 0 9.07s 246 1,742
Gemini 3 Pro Preview 10.0 10.0 100.0% 0 10.84s 279 3,156
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Seed-2.0-Lite 5.9 7.2 55.6% 1 88.74s 15 23,897
Gemini 3 Pro Preview 5.3 10.0 33.3% 0 7.01s 15 1,195
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Seed-2.0-Lite 6.7 3.6 66.7% 1 18.25s 304 1,620
Gemini 3 Pro Preview 10.0 10.0 100.0% 0 9.34s 78 374
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Seed-2.0-Lite 10.0 10.0 100.0% 0 7.26s 71 1,480
Gemini 3 Pro Preview 9.8 10.0 100.0% 0 3.26s 69 754
Puzzle Solving Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Seed-2.0-Lite 9.0 7.9 88.9% 1 11.03s 461 3,532
Gemini 3 Pro Preview 10.0 10.0 100.0% 0 3.91s 243 1,197
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Seed-2.0-Lite 10.0 10.0 100.0% 0 12.38s 222 1,011
Gemini 3 Pro Preview 10.0 10.0 100.0% 0 11.96s 324 971

Быстрое сравнение

Сменить пару сравнения