AI BENCHY Compare
Cobuddy vs MoonshotAI: Kimi K2.5
تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-05-19
| المقياس | Cobuddy Cobuddy medium متاح مجانًا | Kimi K2.5 Kimi K2.5 none |
|---|---|---|
| النتيجة | 5.8 | 5.4 |
| الترتيب | #102 | #119 |
| الموثوقية | 9.9 | 10.0 |
| الاتساق | 6.9 | 8.8 |
| اختبارات صحيحة | ||
| معدل النجاح لكل محاولة | 54.4% | 38.6% |
| اختبارات غير مستقرة | 7 | 3 |
| إجمالي مرات التشغيل | 57 | 57 |
| التكلفة لكل نتيجة | 0.000 | 0.273 |
| إجمالي التكلفة | $0.000 | $0.017 |
| ??? ??????? | $0.000 / 1M | $0.400 / 1M |
| ??? ??????? | $0.000 / 1M | $1.900 / 1M |
| رموز الإخراج | 1,648 | 2,679 |
| رموز الاستدلال | 96,062 | 0 |
| زمن الاستجابة (المتوسط) | 36.50s | 12.58s |
| زمن الاستجابة (الحد الأقصى) | 309.02s | 42.13s |
| زمن الاستجابة (الإجمالي) | 693.45s | 150.95s |
الدرجة مقابل التكلفة الإجمالية
زمن الاستجابة (المتوسط)
النتيجة vs زمن الاستجابة (المتوسط)
إجمالي رموز الإخراج
النتيجة vs إجمالي رموز الإخراج
تفصيل الفئات
مقارنة سريعة
تبديل زوج المقارنة
Cobuddymediumمتاح مجانًاvsQwen3.6 27BnoneCobuddymediumمتاح مجانًاvsOwl AlphanoneCobuddymediumمتاح مجانًاvsQwen3.5-27BnoneCobuddymediumمتاح مجانًاvsMiMo-V2-PrononeCobuddymediumمتاح مجانًاvsGLM 4.7 FlashnoneKimi K2.5nonevsElephant AlphamediumCobuddymediumمتاح مجانًاvsQwen3.5-35B-A3BnoneCobuddymediumمتاح مجانًاvsGPT-5.4noneCobuddymediumمتاح مجانًاvsQwen3.5 Plus 2026-04-20noneMistral Small 4mediumvsKimi K2.5noneCobuddymediumمتاح مجانًاvsKimi K2.6noneMiniMax M2.5mediumمتاح مجانًاvsKimi K2.5none