Навигация
AI BENCHY
Advertise here

AI BENCHY Compare

Сравниваемые модели

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-05-29

Метрика Gemma 4 31B Gemma 4 31B medium Релиз: 2026-04-02 Бесплатно доступно Gemma 4 26B A4B Gemma 4 26B A4B medium Релиз: 2026-04-03 Бесплатно доступно Gemini 3 PRO Preview Gemini 3 PRO Preview medium Релиз: 2025-11-18
Оценка 8.0 7.8 8.1
Ранг #25 #34 #22
Надежность 10.0 10.0 Н/Д
Стабильность 9.2 9.2 10.0
Тестов верно
Доля успешных попыток 75.0% 73.3% 73.7%
Нестабильные тесты 2 2 0
Всего запусков 60 60 60
Стоимость за результат 0.205 0.317 1.406
Общая стоимость $0.029 $0.045 $0.197
Цена входа $0.120 / 1M $0.060 / 1M $0.000 / 1M
Цена выхода $0.370 / 1M $0.330 / 1M $0.000 / 1M
Выходные токены 19,602 28,000 1,490
Токены рассуждений 49,686 82,045 10,102
Время ответа (среднее) 35.39s 50.92s 9.05s
Время ответа (макс.) 150.90s 369.32s 26.24s
Время ответа (суммарно) 637.01s 967.47s 90.53s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemma 4 31B 10.0 10.0 100.0% 0 12.89s 962 2,046
Gemma 4 26B A4B 10.0 10.0 100.0% 0 6.20s 1,142 3,045
Gemini 3 PRO Preview 10.0 10.0 100.0% 0 14.99s 149 1,485
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemma 4 31B 3.8 1.6 50.0% 2 110.94s 8,344 17,172
Gemma 4 26B A4B 2.9 10.0 0.0% 0 258.40s 14,838 26,122
Gemini 3 PRO Preview 3.0 10.0 0.0% 0 0ms 0 0
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemma 4 31B 3.0 10.0 0.0% 0 0ms 0 0
Gemma 4 26B A4B 9.6 10.0 100.0% 0 73.55s 5,415 13,112
Gemini 3 PRO Preview 3.0 10.0 0.0% 0 10.37s 351 952
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemma 4 31B 10.0 10.0 100.0% 0 21.11s 1,822 2,951
Gemma 4 26B A4B 10.0 10.0 100.0% 0 16.51s 1,567 2,827
Gemini 3 PRO Preview 10.0 10.0 100.0% 0 10.84s 279 3,156
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemma 4 31B 7.7 10.0 66.7% 0 38.48s 4,349 8,985
Gemma 4 26B A4B 2.9 4.4 22.2% 2 23.62s 2,469 7,105
Gemini 3 PRO Preview 5.3 10.0 33.3% 0 7.01s 15 1,195
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemma 4 31B 10.0 10.0 100.0% 0 9.57s 105 888
Gemma 4 26B A4B 10.0 10.0 100.0% 0 29.76s 25 5,075
Gemini 3 PRO Preview 10.0 10.0 100.0% 0 9.34s 78 374
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemma 4 31B 10.0 10.0 100.0% 0 12.76s 533 2,035
Gemma 4 26B A4B 10.0 10.0 100.0% 0 17.54s 887 4,470
Gemini 3 PRO Preview 9.8 10.0 100.0% 0 3.26s 69 754
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemma 4 31B 9.9 10.0 100.0% 0 26.91s 1,795 5,595
Gemma 4 26B A4B 10.0 10.0 100.0% 0 5.79s 410 2,128
Gemini 3 PRO Preview 10.0 10.0 100.0% 0 3.88s 225 1,215
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemma 4 31B 3.0 10.0 0.0% 0 0ms 0 0
Gemma 4 26B A4B 10.0 10.0 100.0% 0 9.01s 450 1,256
Gemini 3 PRO Preview 10.0 10.0 100.0% 0 11.96s 324 971
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Gemma 4 31B 3.0 10.0 0.0% 0 90.14s 1,692 10,014
Gemma 4 26B A4B 3.0 10.0 0.0% 0 180.87s 797 16,905
Gemini 3 PRO Preview 0.0 0.0 0.0% 0 0ms 0 0

Быстрое сравнение

Сменить пару сравнения