Навигация
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Cobuddy vs inclusionAI: Ring-2.6-1T

Сводка

Сравнение benchmark Cobuddy vs Ring-2.6-1T: Cobuddy лидирует по среднему баллу: 4.9 vs 4.8. Cobuddy имеет более низкую стоимость benchmark: $0.000 vs $0.026. Cobuddy быстрее: 39.90s vs 55.10s, с долей успешных попыток 47.6% vs 47.6%.

Рекомендуемая модель: Ring-2.6-1T - В этом сравнении у него лучший общий баланс балла, надежности, стоимости и времени ответа.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-06-12

Метрика Cobuddy Cobuddy medium Релиз: 2026-05-06 Ring-2.6-1T Ring-2.6-1T none Релиз: 2026-05-10
Оценка 4.9 4.8
Ранг #144 #148
Надежность 10.0 10.0
Стабильность 7.5 9.3
Тестов верно
Доля успешных попыток 47.6% 47.6%
Нестабильные тесты 6 2
Всего запусков 63 63
Стоимость за результат 0.000 0.000
Общая стоимость $0.000 $0.026
Цена входа $0.000 / 1M $0.075 / 1M
Цена выхода $0.000 / 1M $0.625 / 1M
Общее число входных токенов 37,449 7,599
Выходные токены 1,677 39,954
Токены рассуждений 116,703 0
Время ответа (среднее) 39.90s 55.10s
Время ответа (макс.) 309.02s 143.82s
Время ответа (суммарно) 797.98s 881.55s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Cobuddy 8.7 7.9 91.7% 1 10.00s 453 98 4,666
Ring-2.6-1T 9.2 8.4 91.7% 1 43.33s 810 5,575 0
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Cobuddy 3.7 6.7 22.2% 1 79.17s 4,726 358 30,138
Ring-2.6-1T 5.3 10.0 33.3% 0 143.82s 834 5,036 0
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Cobuddy 3.0 10.0 0.0% 0 47.38s 18,324 465 7,265
Ring-2.6-1T 3.0 10.0 0.0% 0 0ms 0 0 0
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Cobuddy 6.3 5.8 66.7% 1 17.36s 8,181 275 5,591
Ring-2.6-1T 3.0 10.0 0.0% 0 45.87s 2,712 1,529 0
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Cobuddy 2.9 4.4 22.2% 2 128.15s 540 10 49,454
Ring-2.6-1T 5.3 7.2 44.4% 1 73.40s 873 17,728 0
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Cobuddy 4.2 9.9 0.0% 0 23.23s 498 76 3,782
Ring-2.6-1T 4.3 10.0 0.0% 0 15.63s 561 846 0
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Cobuddy 9.8 10.0 100.0% 0 11.60s 508 64 2,842
Ring-2.6-1T 9.8 10.0 100.0% 0 27.36s 774 2,004 0
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Cobuddy 3.6 7.2 22.2% 1 12.83s 561 189 5,808
Ring-2.6-1T 7.7 10.0 66.7% 0 31.47s 792 3,469 0
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Cobuddy 10.0 10.0 100.0% 0 11.19s 3,505 133 294
Ring-2.6-1T 3.0 10.0 0.0% 0 0ms 0 0 0
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Cobuddy 3.0 10.0 0.0% 0 36.98s 153 9 6,863
Ring-2.6-1T 3.0 10.0 0.0% 0 133.60s 243 3,767 0

Быстрое сравнение

Сменить пару сравнения