Навигация
AI BENCHY
Advertise here

AI BENCHY Compare

Google: Gemini 3.1 Flash Lite vs inclusionAI: Ring-2.6-1T

Сводка

Сравнение benchmark Gemini 3.1 Flash Lite vs Ring-2.6-1T: Ring-2.6-1T лидирует по среднему баллу: 6.8 vs 6.1. Gemini 3.1 Flash Lite имеет более низкую стоимость benchmark: $0.013 vs $0.033. Gemini 3.1 Flash Lite быстрее: 1.33s vs 61.29s, с долей успешных попыток 54.0% vs 60.3%.

Рекомендуемая модель: Gemini 3.1 Flash Lite - Его балл близок к лучшему здесь (6.1 против 6.8), при этом он примерно в 2.5 раза дешевле, чем Ring-2.6-1T.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-06-18

Метрика Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite minimal Релиз: 2026-05-08 Ring-2.6-1T Ring-2.6-1T medium Релиз: 2026-05-10
Оценка 6.1 6.8
Ранг #94 #72
Надежность 10.0 10.0
Стабильность 8.8 8.8
Тестов верно
Доля успешных попыток 54.0% 60.3%
Нестабильные тесты 3 3
Всего запусков 63 63
Стоимость за результат 0.130 0.000
Общая стоимость $0.013 $0.033
Цена входа $0.250 / 1M $0.075 / 1M
Цена выхода $1.500 / 1M $0.625 / 1M
Общее число входных токенов 36,973 35,892
Выходные токены 2,487 21,752
Токены рассуждений 0 42,754
Время ответа (среднее) 1.33s 61.29s
Время ответа (макс.) 4.49s 304.19s
Время ответа (суммарно) 27.91s 1164.50s

Генерация showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#94 Gemini 3.1 Flash Lite

minimal
Стоимость
$0.001
Время
3.7s
Токены
635 tok

#72 Ring-2.6-1T

medium
Ring-2.6-1T is no longer available as a free model. It has transitioned to a paid model. Continue using it here: https://openrouter.ai/inclusionai/ring-2.6-1t
Стоимость
$0.000
Время
0.1s
Токены
0 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite 8.3 10.0 75.0% 0 1.10s 500 639 0
Ring-2.6-1T 10.0 10.0 100.0% 0 42.21s 810 3,833 4,891
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite 5.5 10.0 33.3% 0 831ms 8,126 666 0
Ring-2.6-1T 5.3 10.0 33.3% 0 59.65s 834 1,369 3,985
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite 3.0 10.0 0.0% 0 2.53s 12,870 357 0
Ring-2.6-1T 10.0 10.0 100.0% 0 304.19s 14,823 324 6,088
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 1.04s 7,552 279 0
Ring-2.6-1T 6.5 10.0 50.0% 0 37.36s 8,046 840 1,937
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite 2.9 7.2 11.1% 1 1.02s 641 15 0
Ring-2.6-1T 3.5 4.4 33.3% 2 64.92s 873 9,744 15,013
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite 4.0 10.0 0.0% 0 791ms 490 63 0
Ring-2.6-1T 4.1 10.0 0.0% 0 58.26s 561 150 583
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 932ms 615 72 0
Ring-2.6-1T 9.8 10.0 100.0% 0 11.78s 774 266 1,831
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite 6.0 4.6 66.7% 2 2.15s 564 153 0
Ring-2.6-1T 5.9 7.2 55.6% 1 20.73s 792 697 2,479
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 3.51s 5,457 234 0
Ring-2.6-1T 10.0 10.0 100.0% 0 104.44s 8,136 234 1,531
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Gemini 3.1 Flash Lite 3.0 10.0 0.0% 0 724ms 158 9 0
Ring-2.6-1T 3.0 10.0 0.0% 0 113.91s 243 4,295 4,416

Быстрое сравнение

Сменить пару сравнения