Навигация
AI BENCHY
Your ad here

AI BENCHY Compare

Anthropic: Claude Opus 4.7 vs Anthropic: Claude Opus 4.7

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-04-16

Метрика Claude Opus 4.7 Claude Opus 4.7 medium Релиз: 2026-04-16 Claude Opus 4.7 Claude Opus 4.7 none Релиз: 2026-04-16
Оценка 9.2 9.2
Ранг #3 #4
Стабильность 10.0 10.0
Тестов верно
Доля успешных попыток 88.9% 88.9%
Нестабильные тесты 0 0
Всего запусков 54 54
Стоимость за результат 2.790 3.155
Общая стоимость $0.447 $0.505
???? ????? $5.000 / 1M $5.000 / 1M
???? ?????? $25.000 / 1M $25.000 / 1M
Выходные токены 5,375 6,326
Токены рассуждений 1,341 0
Время ответа (среднее) 3.53s 3.13s
Время ответа (макс.) 21.45s 18.27s
Время ответа (суммарно) 60.03s 56.33s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Opus 4.7 8.3 10.0 75.0% 0 1.85s 348 0
Claude Opus 4.7 8.3 10.0 75.0% 0 2.12s 522 0
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Opus 4.7 10.0 10.0 100.0% 0 6.41s 1,141 257
Claude Opus 4.7 10.0 10.0 100.0% 0 2.84s 494 0
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Opus 4.7 10.0 10.0 100.0% 0 21.45s 2,369 1,084
Claude Opus 4.7 9.5 10.0 100.0% 0 18.27s 3,504 0
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Opus 4.7 10.0 10.0 100.0% 0 2.37s 324 0
Claude Opus 4.7 10.0 10.0 100.0% 0 2.15s 324 0
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Opus 4.7 7.7 10.0 66.7% 0 1.17s 51 0
Claude Opus 4.7 7.7 10.0 66.7% 0 1.19s 78 0
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Opus 4.7 10.0 10.0 100.0% 0 2.87s 256 0
Claude Opus 4.7 10.0 10.0 100.0% 0 3.47s 257 0
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Opus 4.7 10.0 10.0 100.0% 0 1.57s 114 0
Claude Opus 4.7 10.0 10.0 100.0% 0 1.46s 114 0
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Opus 4.7 10.0 10.0 100.0% 0 2.51s 399 0
Claude Opus 4.7 10.0 10.0 100.0% 0 2.58s 661 0
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Opus 4.7 10.0 10.0 100.0% 0 4.17s 373 0
Claude Opus 4.7 10.0 10.0 100.0% 0 4.74s 372 0

Быстрое сравнение

Сменить пару сравнения