Навигация
AI BENCHY
Your ad here

AI BENCHY Compare

Anthropic: Claude Opus 4.7 vs Google: Gemini 3 Flash Preview

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-04-16

Метрика Claude Opus 4.7 Claude Opus 4.7 none Релиз: 2026-04-16 Gemini 3 Flash Preview Gemini 3 Flash Preview low Релиз: 2025-12-17
Оценка 9.2 8.8
Ранг #4 #5
Стабильность 10.0 9.5
Тестов верно
Доля успешных попыток 88.9% 85.2%
Нестабильные тесты 0 1
Всего запусков 54 54
Стоимость за результат 3.155 0.604
Общая стоимость $0.505 $0.091
???? ????? $5.000 / 1M $0.500 / 1M
???? ?????? $25.000 / 1M $3.000 / 1M
Выходные токены 6,326 2,018
Токены рассуждений 0 23,273
Время ответа (среднее) 3.13s 6.01s
Время ответа (макс.) 18.27s 14.72s
Время ответа (суммарно) 56.33s 108.12s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Opus 4.7 8.3 10.0 75.0% 0 2.12s 522 0
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 3.48s 281 3,082
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Opus 4.7 10.0 10.0 100.0% 0 2.84s 494 0
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 6.94s 426 2,717
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Opus 4.7 9.5 10.0 100.0% 0 18.27s 3,504 0
Gemini 3 Flash Preview 3.0 10.0 0.0% 0 3.27s 326 0
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Opus 4.7 10.0 10.0 100.0% 0 2.15s 324 0
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 9.40s 279 3,656
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Opus 4.7 7.7 10.0 66.7% 0 1.19s 78 0
Gemini 3 Flash Preview 5.3 7.2 44.4% 1 8.05s 12 6,410
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Opus 4.7 10.0 10.0 100.0% 0 3.47s 257 0
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 3.68s 120 981
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Opus 4.7 10.0 10.0 100.0% 0 1.46s 114 0
Gemini 3 Flash Preview 9.9 10.0 100.0% 0 7.02s 71 2,752
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Opus 4.7 10.0 10.0 100.0% 0 2.58s 661 0
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 6.11s 269 3,260
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Opus 4.7 10.0 10.0 100.0% 0 4.74s 372 0
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.99s 234 415

Быстрое сравнение

Сменить пару сравнения