Навигация
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

ByteDance Seed: Seed-2.0-Mini vs OpenAI: GPT-5.3 Chat

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-06-04

Метрика Seed-2.0-Mini Seed-2.0-Mini medium Релиз: 2026-02-14 GPT-5.3 Chat GPT-5.3 Chat none Релиз: 2026-03-03
Оценка 6.9 7.2
Ранг #73 #63
Надежность 6.7 10.0
Стабильность 9.3 8.1
Тестов верно
Доля успешных попыток 57.1% 66.7%
Нестабильные тесты 2 5
Всего запусков 63 63
Стоимость за результат 0.397 3.605
Общая стоимость $0.044 $0.433
Цена входа $0.100 / 1M $1.750 / 1M
Цена выхода $0.400 / 1M $14.000 / 1M
Общее число входных токенов 41,904 34,209
Выходные токены 2,555 26,617
Токены рассуждений 95,974 0
Время ответа (среднее) 80.22s 6.34s
Время ответа (макс.) 262.83s 18.33s
Время ответа (суммарно) 1363.72s 133.13s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Seed-2.0-Mini 6.6 10.0 50.0% 0 74.75s 791 360 9,520
GPT-5.3 Chat 6.7 8.1 58.3% 1 3.86s 606 3,167 0
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Seed-2.0-Mini 5.5 9.8 33.3% 0 220.48s 3,823 464 34,964
GPT-5.3 Chat 5.6 4.7 55.6% 2 10.52s 7,302 6,632 0
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Seed-2.0-Mini 10.0 10.0 100.0% 0 262.83s 16,533 404 29,806
GPT-5.3 Chat 10.0 10.0 100.0% 0 11.96s 11,019 2,614 0
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Seed-2.0-Mini 10.0 10.0 100.0% 0 24.27s 8,568 246 2,743
GPT-5.3 Chat 10.0 10.0 100.0% 0 2.21s 7,140 942 0
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Seed-2.0-Mini 3.0 10.0 0.0% 0 0ms 0 0 0
GPT-5.3 Chat 3.5 4.4 33.3% 2 13.01s 723 8,264 0
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Seed-2.0-Mini 5.1 3.4 33.3% 1 36.65s 585 213 4,210
GPT-5.3 Chat 4.6 10.0 0.0% 0 1.99s 477 319 0
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Seed-2.0-Mini 10.0 10.0 100.0% 0 17.47s 840 69 2,050
GPT-5.3 Chat 9.8 10.0 100.0% 0 3.51s 660 1,491 0
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Seed-2.0-Mini 8.2 7.2 88.9% 1 31.79s 903 527 5,667
GPT-5.3 Chat 10.0 10.0 100.0% 0 2.99s 642 1,758 0
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Seed-2.0-Mini 10.0 10.0 100.0% 0 88.68s 9,585 222 5,235
GPT-5.3 Chat 10.0 10.0 100.0% 0 8.36s 5,445 861 0
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Seed-2.0-Mini 3.0 10.0 0.0% 0 56.76s 276 50 1,779
GPT-5.3 Chat 3.0 10.0 0.0% 0 4.38s 195 569 0

Быстрое сравнение

Сменить пару сравнения