Навигация
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Anthropic: Claude Sonnet 4.6 vs inclusionAI: Ring-2.6-1T

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-05-19

Метрика Claude Sonnet 4.6 Claude Sonnet 4.6 none Релиз: 2026-02-17 Ring-2.6-1T Ring-2.6-1T none Релиз: 2026-05-10
Оценка 7.2 7.2
Ранг #68 #62
Надежность 10.0 9.8
Стабильность 9.6 9.1
Тестов верно
Доля успешных попыток 61.4% 62.5%
Нестабильные тесты 1 2
Всего запусков 57 57
Стоимость за результат 2.441 0.000
Общая стоимость $0.269 $0.000
???? ????? $3.000 / 1M $0.075 / 1M
???? ?????? $15.000 / 1M $0.625 / 1M
Выходные токены 7,864 39,954
Токены рассуждений 0 0
Время ответа (среднее) 4.96s 55.10s
Время ответа (макс.) 23.84s 143.82s
Время ответа (суммарно) 59.50s 881.55s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Sonnet 4.6 4.8 10.0 25.0% 0 2.94s 1,214 0
Ring-2.6-1T 9.2 8.4 91.7% 1 43.33s 5,575 0
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Sonnet 4.6 10.0 10.0 100.0% 0 3.67s 523 0
Ring-2.6-1T 10.0 10.0 100.0% 0 143.82s 5,036 0
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Sonnet 4.6 9.5 10.0 100.0% 0 23.84s 3,766 0
Ring-2.6-1T 0.0 0.0 0.0% 0 0ms 0 0
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Sonnet 4.6 10.0 10.0 100.0% 0 3.43s 252 0
Ring-2.6-1T 3.0 10.0 0.0% 0 45.87s 1,529 0
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Sonnet 4.6 7.7 10.0 66.7% 0 3.54s 413 0
Ring-2.6-1T 5.3 7.2 44.4% 1 73.40s 17,728 0
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Sonnet 4.6 6.1 3.1 66.7% 1 2.56s 192 0
Ring-2.6-1T 4.3 10.0 0.0% 0 15.63s 846 0
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Sonnet 4.6 6.5 10.0 50.0% 0 1.96s 90 0
Ring-2.6-1T 9.8 10.0 100.0% 0 27.36s 2,004 0
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Sonnet 4.6 7.7 10.0 66.7% 0 2.92s 536 0
Ring-2.6-1T 7.7 10.0 66.7% 0 31.47s 3,469 0
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Sonnet 4.6 10.0 10.0 100.0% 0 4.11s 447 0
Ring-2.6-1T 0.0 0.0 0.0% 0 0ms 0 0
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Claude Sonnet 4.6 3.0 10.0 0.0% 0 4.67s 431 0
Ring-2.6-1T 3.0 10.0 0.0% 0 133.60s 3,767 0

Быстрое сравнение

Сменить пару сравнения