Навигация
AI BENCHY
Your ad here

AI BENCHY Compare

Anthropic: Claude Opus 4.7 vs ByteDance Seed: Seed-2.0-Lite

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-04-16

Метрика Claude Opus 4.7 Claude Opus 4.7 none Релиз: 2026-04-16 Seed-2.0-Lite Seed-2.0-Lite medium Релиз: 2026-02-14
Оценка 9.2 8.6
Ранг #4 #6
Стабильность 10.0 8.8
Тестов верно
Доля успешных попыток 88.9% 83.3%
Нестабильные тесты 0 3
Всего запусков 54 54
Стоимость за результат 3.155 0.926
Общая стоимость $0.505 $0.121
???? ????? $5.000 / 1M $0.250 / 1M
???? ?????? $25.000 / 1M $2.000 / 1M
Выходные токены 6,326 3,257
Токены рассуждений 0 52,042
Время ответа (среднее) 3.13s 30.37s
Время ответа (макс.) 18.27s 168.71s
Время ответа (суммарно) 56.33s 546.72s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Opus 4.7 8.3 10.0 75.0% 0 2.12s 522 0
Seed-2.0-Lite 8.3 10.0 75.0% 0 17.99s 996 7,142
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Opus 4.7 10.0 10.0 100.0% 0 2.84s 494 0
Seed-2.0-Lite 10.0 10.0 100.0% 0 74.49s 436 7,319
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Opus 4.7 9.5 10.0 100.0% 0 18.27s 3,504 0
Seed-2.0-Lite 10.0 10.0 100.0% 0 37.67s 506 4,299
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Opus 4.7 10.0 10.0 100.0% 0 2.15s 324 0
Seed-2.0-Lite 10.0 10.0 100.0% 0 9.07s 246 1,742
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Opus 4.7 7.7 10.0 66.7% 0 1.19s 78 0
Seed-2.0-Lite 5.9 7.2 55.6% 1 88.74s 15 23,897
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Opus 4.7 10.0 10.0 100.0% 0 3.47s 257 0
Seed-2.0-Lite 6.7 3.6 66.7% 1 18.25s 304 1,620
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Opus 4.7 10.0 10.0 100.0% 0 1.46s 114 0
Seed-2.0-Lite 10.0 10.0 100.0% 0 7.26s 71 1,480
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Opus 4.7 10.0 10.0 100.0% 0 2.58s 661 0
Seed-2.0-Lite 9.0 7.9 88.9% 1 11.03s 461 3,532
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Opus 4.7 10.0 10.0 100.0% 0 4.74s 372 0
Seed-2.0-Lite 10.0 10.0 100.0% 0 12.38s 222 1,011

Быстрое сравнение

Сменить пару сравнения