Навигация
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

ByteDance Seed: Seed-2.0-Mini vs OpenAI: GPT-5.3 Chat

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-04-16

Метрика Seed-2.0-Mini Seed-2.0-Mini medium Релиз: 2026-02-14 GPT-5.3 Chat GPT-5.3 Chat none Релиз: 2026-03-03
Оценка 7.5 7.7
Ранг #38 #35
Стабильность 9.2 8.6
Тестов верно
Доля успешных попыток 66.7% 68.5%
Нестабильные тесты 2 3
Всего запусков 54 54
Стоимость за результат 0.333 3.082
Общая стоимость $0.037 $0.340
???? ????? $0.100 / 1M $1.750 / 1M
???? ?????? $0.400 / 1M $14.000 / 1M
Выходные токены 2,419 20,784
Токены рассуждений 79,238 0
Время ответа (среднее) 69.70s 5.88s
Время ответа (макс.) 262.83s 18.33s
Время ответа (суммарно) 1045.47s 105.90s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Seed-2.0-Mini 6.6 10.0 50.0% 0 74.75s 360 9,520
GPT-5.3 Chat 6.7 8.1 58.3% 1 3.86s 3,167 0
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Seed-2.0-Mini 10.0 10.0 100.0% 0 197.31s 448 20,614
GPT-5.3 Chat 10.0 10.0 100.0% 0 9.32s 1,436 0
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Seed-2.0-Mini 10.0 10.0 100.0% 0 262.83s 404 29,806
GPT-5.3 Chat 10.0 10.0 100.0% 0 11.96s 2,614 0
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Seed-2.0-Mini 10.0 10.0 100.0% 0 24.27s 246 2,743
GPT-5.3 Chat 10.0 10.0 100.0% 0 2.21s 942 0
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Seed-2.0-Mini 3.0 10.0 0.0% 0 0ms 0 0
GPT-5.3 Chat 3.5 4.4 33.3% 2 13.01s 8,264 0
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Seed-2.0-Mini 5.1 3.4 33.3% 1 36.65s 213 4,210
GPT-5.3 Chat 4.6 10.0 0.0% 0 1.99s 319 0
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Seed-2.0-Mini 10.0 10.0 100.0% 0 17.47s 69 2,050
GPT-5.3 Chat 8.3 10.0 50.0% 0 3.29s 1,455 0
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Seed-2.0-Mini 8.2 7.2 88.9% 1 25.85s 457 5,060
GPT-5.3 Chat 10.0 10.0 100.0% 0 2.93s 1,726 0
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Seed-2.0-Mini 10.0 10.0 100.0% 0 88.68s 222 5,235
GPT-5.3 Chat 10.0 10.0 100.0% 0 8.36s 861 0

Быстрое сравнение

Сменить пару сравнения