AI BENCHY Compare

inclusionAI: Ring-2.6-1T vs Hunter Alpha

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-05-22

Метрика	Ring-2.6-1T Ring-2.6-1T medium Релиз: 2026-05-10	Hunter Alpha Hunter Alpha none Релиз: 2026-03-11

Метрика	Ring-2.6-1T Ring-2.6-1T medium Релиз: 2026-05-10	Hunter Alpha Hunter Alpha none Релиз: 2026-03-11
Оценка	7.2	5.7
Ранг	#61	#108
Надежность	9.9	Н/Д
Стабильность	8.7	8.2
Тестов верно
Доля успешных попыток	66.7%	46.3%
Нестабильные тесты	3	4
Всего запусков	60	52
Стоимость за результат	0.000	0.000
Общая стоимость	$0.000	$0.000
???? ?????	$0.075 / 1M	$0.000 / 1M
???? ??????	$0.625 / 1M	$0.000 / 1M
Выходные токены	21,752	2,278
Токены рассуждений	42,754	0
Время ответа (среднее)	61.29s	4.58s
Время ответа (макс.)	304.19s	15.17s
Время ответа (суммарно)	1164.50s	77.92s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Ring-2.6-1T	10.0	10.0	100.0%	0		42.21s	3,833	4,891
Hunter Alpha	3.5	8.0	16.7%	1		3.81s	779	0

Программирование	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Ring-2.6-1T	10.0	10.0	100.0%	0		59.65s	1,369	3,985
Hunter Alpha	3.0	10.0	0.0%	0		0ms	0	0

Комбинированный	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Ring-2.6-1T	10.0	10.0	100.0%	0		304.19s	324	6,088
Hunter Alpha	3.0	10.0	0.0%	0		15.17s	379	0

Парсинг и извлечение данных	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Ring-2.6-1T	6.5	10.0	50.0%	0		37.36s	840	1,937
Hunter Alpha	10.0	10.0	100.0%	0		8.49s	249	0

Предметно-ориентированное	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Ring-2.6-1T	3.5	4.4	33.3%	2		64.92s	9,744	15,013
Hunter Alpha	5.3	10.0	33.3%	0		2.33s	27	0

Общий интеллект	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Ring-2.6-1T	4.1	10.0	0.0%	0		58.26s	150	583
Hunter Alpha	6.1	3.1	66.7%	1		2.71s	91	0

Следование инструкциям	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Ring-2.6-1T	9.8	10.0	100.0%	0		11.78s	266	1,831
Hunter Alpha	6.4	10.0	50.0%	0		2.82s	69	0

Решение головоломок	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Ring-2.6-1T	5.9	7.2	55.6%	1		20.73s	697	2,479
Hunter Alpha	5.8	4.4	66.7%	2		3.06s	349	0

Вызов инструментов	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Ring-2.6-1T	10.0	10.0	100.0%	0		104.44s	234	1,531
Hunter Alpha	10.0	10.0	100.0%	0		6.02s	335	0

Эрудиция	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Ring-2.6-1T	3.0	10.0	0.0%	0		113.91s	4,295	4,416
Hunter Alpha	-	-	-	-	-	-	-	-

Быстрое сравнение

Сменить пару сравнения

Ring-2.6-1TmediumvsQwen3.6 Max Previewnone DeepSeek V4 FlashhighБесплатно доступноvsRing-2.6-1Tmedium Ring-2.6-1TmediumvsGPT-5.3 Chatnone Gemini 3.1 Flash LitelowvsRing-2.6-1Tmedium Claude Sonnet 4.6nonevsRing-2.6-1Tmedium Gemini 3.1 Flash Lite PreviewnonevsRing-2.6-1Tmedium Ring-2.6-1TmediumvsGPT-5.2 Chatnone Gemini 3.1 Flash Lite PreviewlowvsRing-2.6-1Tmedium Gemini 3 Flash PreviewnonevsRing-2.6-1Tmedium Gemma 4 31BnoneБесплатно доступноvsRing-2.6-1Tmedium Gemini 3.1 Flash LiteminimalvsRing-2.6-1Tmedium DeepSeek V4 ProhighvsRing-2.6-1Tmedium