AI BENCHY Compare

Anthropic: Claude Opus 4.7 vs Google: Gemma 4 31B

Сводка

Сравнение benchmark Claude Opus 4.7 vs Gemma 4 31B: Claude Opus 4.7 лидирует по среднему баллу: 7.4 vs 6.3. Gemma 4 31B имеет более низкую стоимость benchmark: $0.033 vs $0.505. Claude Opus 4.7 быстрее: 3.02s vs 56.55s, с долей успешных попыток 76.2% vs 69.8%.

Рекомендуемая модель: Claude Opus 4.7 - Здесь у него лучший балл (7.4), и он отвечает примерно в 18.7 раза быстрее, чем Gemma 4 31B.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-06-18

Метрика	Claude Opus 4.7 Claude Opus 4.7 none Релиз: 2026-04-16	Gemma 4 31B Gemma 4 31B medium Релиз: 2026-04-02 Бесплатно доступно

Метрика	Claude Opus 4.7 Claude Opus 4.7 none Релиз: 2026-04-16	Gemma 4 31B Gemma 4 31B medium Релиз: 2026-04-02 Бесплатно доступно
Оценка	7.4	6.3
Ранг	#49	#88
Надежность	10.0	10.0
Стабильность	9.0	9.4
Тестов верно
Доля успешных попыток	76.2%	69.8%
Нестабильные тесты	0	1
Всего запусков	57	63
Стоимость за результат	3.154	0.257
Общая стоимость	$0.505	$0.033
Цена входа	$5.000 / 1M	$0.120 / 1M
Цена выхода	$25.000 / 1M	$0.350 / 1M
Общее число входных токенов	69,576	17,957
Выходные токены	6,265	22,356
Токены рассуждений	0	65,726
Время ответа (среднее)	3.02s	56.55s
Время ответа (макс.)	18.27s	437.40s
Время ответа (суммарно)	57.44s	1074.41s

Генерация showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#49 Claude Opus 4.7

none

Стоимость: $0.051
Время: 24.2s
Токены: 2,181 tok

#88 Gemma 4 31B

medium

Стоимость: $0.002
Время: 45.7s
Токены: 2,696 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Claude Opus 4.7	8.3	10.0	75.0%	0		2.12s	894	522	0
Gemma 4 31B	10.0	10.0	100.0%	0		12.89s	816	962	2,046

Программирование	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Claude Opus 4.7	3.3	3.3	33.3%	0		2.84s	1,176	494	0
Gemma 4 31B	4.3	5.8	22.2%	1		219.76s	5,568	11,098	33,212

Комбинированный	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Claude Opus 4.7	9.5	10.0	100.0%	0		18.27s	37,740	3,504	0
Gemma 4 31B	3.0	10.0	0.0%	0		0ms	0	0	0

Парсинг и извлечение данных	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Claude Opus 4.7	10.0	10.0	100.0%	0		2.15s	10,533	324	0
Gemma 4 31B	10.0	10.0	100.0%	0		21.11s	8,334	1,822	2,951

Предметно-ориентированное	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Claude Opus 4.7	7.7	10.0	66.7%	0		1.19s	1,020	78	0
Gemma 4 31B	7.7	10.0	66.7%	0		38.48s	876	4,349	8,985

Общий интеллект	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Claude Opus 4.7	10.0	10.0	100.0%	0		3.47s	723	257	0
Gemma 4 31B	10.0	10.0	100.0%	0		9.57s	567	105	888

Следование инструкциям	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Claude Opus 4.7	10.0	10.0	100.0%	0		1.46s	939	114	0
Gemma 4 31B	10.0	10.0	100.0%	0		12.76s	777	533	2,035

Решение головоломок	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Claude Opus 4.7	10.0	10.0	100.0%	0		2.46s	939	597	0
Gemma 4 31B	9.9	10.0	100.0%	0		26.91s	801	1,795	5,595

Вызов инструментов	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Claude Opus 4.7	10.0	10.0	100.0%	0		4.74s	15,339	372	0
Gemma 4 31B	3.0	10.0	0.0%	0		0ms	0	0	0

Эрудиция	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
Claude Opus 4.7	3.0	10.0	0.0%	0		1.46s	273	3	0
Gemma 4 31B	3.0	10.0	0.0%	0		90.14s	218	1,692	10,014

Быстрое сравнение

Сменить пару сравнения