AI BENCHY Compare

Anthropic: Claude Opus 4.7 vs Gemini 3 PRO Preview

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-05-29

Метрика	Claude Opus 4.7 Claude Opus 4.7 medium Релиз: 2026-04-16	Gemini 3 PRO Preview Gemini 3 PRO Preview medium Релиз: 2025-11-18

Метрика	Claude Opus 4.7 Claude Opus 4.7 medium Релиз: 2026-04-16	Gemini 3 PRO Preview Gemini 3 PRO Preview medium Релиз: 2025-11-18
Оценка	8.9	8.1
Ранг	#7	#22
Надежность	10.0	Н/Д
Стабильность	10.0	10.0
Тестов верно
Доля успешных попыток	85.0%	73.7%
Нестабильные тесты	0	0
Всего запусков	60	60
Стоимость за результат	3.670	1.406
Общая стоимость	$0.624	$0.197
Цена входа	$5.000 / 1M	$0.000 / 1M
Цена выхода	$25.000 / 1M	$0.000 / 1M
Выходные токены	10,439	1,490
Токены рассуждений	2,198	10,102
Время ответа (среднее)	4.48s	9.05s
Время ответа (макс.)	23.18s	26.24s
Время ответа (суммарно)	85.21s	90.53s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Claude Opus 4.7	8.3	10.0	75.0%	0		1.85s	348	0
Gemini 3 PRO Preview	10.0	10.0	100.0%	0		14.99s	149	1,485

Программирование	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Claude Opus 4.7	10.0	10.0	100.0%	0		14.79s	6,210	1,114
Gemini 3 PRO Preview	3.0	10.0	0.0%	0		0ms	0	0

Комбинированный	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Claude Opus 4.7	10.0	10.0	100.0%	0		21.45s	2,369	1,084
Gemini 3 PRO Preview	3.0	10.0	0.0%	0		10.37s	351	952

Парсинг и извлечение данных	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Claude Opus 4.7	10.0	10.0	100.0%	0		2.37s	324	0
Gemini 3 PRO Preview	10.0	10.0	100.0%	0		10.84s	279	3,156

Предметно-ориентированное	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Claude Opus 4.7	7.7	10.0	66.7%	0		1.17s	51	0
Gemini 3 PRO Preview	5.3	10.0	33.3%	0		7.01s	15	1,195

Общий интеллект	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Claude Opus 4.7	10.0	10.0	100.0%	0		2.87s	256	0
Gemini 3 PRO Preview	10.0	10.0	100.0%	0		9.34s	78	374

Следование инструкциям	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Claude Opus 4.7	10.0	10.0	100.0%	0		1.57s	114	0
Gemini 3 PRO Preview	9.8	10.0	100.0%	0		3.26s	69	754

Решение головоломок	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Claude Opus 4.7	10.0	10.0	100.0%	0		2.43s	370	0
Gemini 3 PRO Preview	10.0	10.0	100.0%	0		3.88s	225	1,215

Вызов инструментов	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Claude Opus 4.7	10.0	10.0	100.0%	0		4.17s	373	0
Gemini 3 PRO Preview	10.0	10.0	100.0%	0		11.96s	324	971

Эрудиция	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Claude Opus 4.7	3.0	10.0	0.0%	0		2.25s	24	0
Gemini 3 PRO Preview	0.0	0.0	0.0%	0		0ms	0	0

Быстрое сравнение

Сменить пару сравнения

Claude Opus 4.7mediumvsGPT-5.5low Claude Opus 4.7mediumvsGemini 3.5 Flashnone Gemini 3 PRO PreviewmediumvsQwen3.7 Maxnone Claude Opus 4.7mediumvsGemini 3 Flash Previewlow Gemini 3 PRO PreviewmediumvsGPT-5.2 Chatnone Claude Opus 4.7mediumvsGemini 3.5 Flashlow DeepSeek V4 FlashhighБесплатно доступноvsGemini 3 PRO Previewmedium Claude Opus 4.7mediumvsGemini 3.5 Flashhigh Gemini 3 PRO PreviewmediumvsGPT-5.3 Chatnone Gemini 3 PRO PreviewmediumvsStep 3.7 Flashlow Gemini 3 PRO PreviewmediumvsGPT-5.5low Claude Opus 4.8nonevsGemini 3 PRO Previewmedium