Навигация
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Anthropic: Claude Opus 4.7 vs Google: Gemini 3 Flash Preview

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-04-16

Метрика Claude Opus 4.7 Claude Opus 4.7 medium Релиз: 2026-04-16 Gemini 3 Flash Preview Gemini 3 Flash Preview medium Релиз: 2025-12-17
Оценка 9.2 10.0
Ранг #3 #1
Стабильность 10.0 10.0
Тестов верно
Доля успешных попыток 88.9% 100.0%
Нестабильные тесты 0 0
Всего запусков 54 54
Стоимость за результат 2.790 1.740
Общая стоимость $0.447 $0.314
???? ????? $5.000 / 1M $0.500 / 1M
???? ?????? $25.000 / 1M $3.000 / 1M
Выходные токены 5,375 2,072
Токены рассуждений 1,341 97,041
Время ответа (среднее) 3.53s 17.60s
Время ответа (макс.) 21.45s 79.71s
Время ответа (суммарно) 60.03s 193.57s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Opus 4.7 8.3 10.0 75.0% 0 1.85s 348 0
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.13s 305 3,490
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Opus 4.7 10.0 10.0 100.0% 0 6.41s 1,141 257
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 79.71s 432 48,771
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Opus 4.7 10.0 10.0 100.0% 0 21.45s 2,369 1,084
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 50.16s 351 12,645
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Opus 4.7 10.0 10.0 100.0% 0 2.37s 324 0
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.72s 279 5,333
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Opus 4.7 7.7 10.0 66.7% 0 1.17s 51 0
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 21.12s 12 14,908
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Opus 4.7 10.0 10.0 100.0% 0 2.87s 256 0
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.09s 111 1,285
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Opus 4.7 10.0 10.0 100.0% 0 1.57s 114 0
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 6.10s 72 4,558
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Opus 4.7 10.0 10.0 100.0% 0 2.51s 399 0
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.43s 276 4,921
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Opus 4.7 10.0 10.0 100.0% 0 4.17s 373 0
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 10.55s 234 1,130

Быстрое сравнение

Сменить пару сравнения