AI BENCHY Compare

Ling 2.6 1t vs OpenAI: gpt-oss-120b

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-04-23

Метрика	Ling 2.6 1t Ling 2.6 1t none Релиз: 2026-04-23 Бесплатно доступно	gpt-oss-120b gpt-oss-120b medium Релиз: 2025-08-05 Бесплатно доступно

Метрика	Ling 2.6 1t Ling 2.6 1t none Релиз: 2026-04-23 Бесплатно доступно	gpt-oss-120b gpt-oss-120b medium Релиз: 2025-08-05 Бесплатно доступно
Оценка	4.5	5.8
Ранг	#105	#73
Стабильность	10.0	7.2
Тестов верно
Доля успешных попыток	16.7%	51.9%
Нестабильные тесты	0	6
Всего запусков	54	54
Стоимость за результат	0.000	0.144
Общая стоимость	$0.000	$0.011
???? ?????	$0.000 / 1M	$0.000 / 1M
???? ??????	$0.000 / 1M	$0.000 / 1M
Выходные токены	2,434	13,493
Токены рассуждений	0	36,879
Время ответа (среднее)	8.79s	16.08s
Время ответа (макс.)	25.72s	50.92s
Время ответа (суммарно)	158.19s	176.88s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Ling 2.6 1t	3.4	10.0	0.0%	0		6.55s	777	0
gpt-oss-120b	6.7	9.9	50.0%	0		10.21s	3,518	2,177

Программирование	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Ling 2.6 1t	5.5	10.0	0.0%	0		10.57s	381	0
gpt-oss-120b	4.3	1.1	66.7%	1		26.33s	228	2,549

Комбинированный	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Ling 2.6 1t	3.0	10.0	0.0%	0		23.53s	183	0
gpt-oss-120b	10.0	10.0	100.0%	0		31.18s	694	5,072

Парсинг и извлечение данных	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Ling 2.6 1t	10.0	10.0	100.0%	0		1.37s	285	0
gpt-oss-120b	6.4	5.9	66.7%	1		1.98s	241	1,114

Предметно-ориентированное	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Ling 2.6 1t	3.0	10.0	0.0%	0		1.04s	27	0
gpt-oss-120b	2.9	4.4	22.2%	2		50.92s	6,784	20,606

Общий интеллект	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Ling 2.6 1t	5.0	10.0	0.0%	0		20.34s	140	0
gpt-oss-120b	4.3	10.0	0.0%	0		7.90s	107	387

Следование инструкциям	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Ling 2.6 1t	6.4	10.0	50.0%	0		5.36s	81	0
gpt-oss-120b	9.9	10.0	100.0%	0		7.63s	126	1,799

Решение головоломок	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Ling 2.6 1t	3.1	10.0	0.0%	0		11.76s	131	0
gpt-oss-120b	3.2	4.7	22.2%	2		11.80s	1,508	2,092

Вызов инструментов	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Ling 2.6 1t	3.0	10.0	0.0%	0		25.72s	429	0
gpt-oss-120b	9.8	10.0	100.0%	0		6.91s	287	1,083

Быстрое сравнение

Сменить пару сравнения

Kimi K2.6nonevsgpt-oss-120bmediumБесплатно доступно gpt-oss-120bmediumБесплатно доступноvsQwen3.5-27Bnone gpt-oss-120bmediumБесплатно доступноvsMiMo-V2.5-Pronone Ling 2.6 1tnoneБесплатно доступноvsQwen3.5-9Bmedium gpt-oss-120bmediumБесплатно доступноvsQwen3.5-122B-A10Bnone Ling 2.6 1tnoneБесплатно доступноvsGLM 4.7 Flashmedium gpt-oss-120bmediumБесплатно доступноvsMiMo-V2-Pronone Ling 2.6 1tnoneБесплатно доступноvsQwen3 Coder Nextmedium gpt-oss-120bmediumБесплатно доступноvsGLM 4.7 Flashnone gpt-oss-120bmediumБесплатно доступноvsGLM 5.1none DeepSeek V3.2nonevsgpt-oss-120bmediumБесплатно доступно gpt-oss-120bmediumБесплатно доступноvsQwen3.5-35B-A3Bnone