AI BENCHY Compare
Cobuddy vs OpenAI: GPT-5.4
تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-05-06
| المقياس | Cobuddy Cobuddy medium متاح مجانًا | GPT-5.4 GPT-5.4 none |
|---|---|---|
| النتيجة | 6.0 | 5.9 |
| الترتيب | #90 | #92 |
| الموثوقية | 9.9 | غير متاح |
| الاتساق | 6.7 | 9.1 |
| اختبارات صحيحة | ||
| معدل النجاح لكل محاولة | 57.4% | 42.6% |
| اختبارات غير مستقرة | 7 | 2 |
| إجمالي مرات التشغيل | 54 | 54 |
| التكلفة لكل نتيجة | 0.000 | 1.477 |
| إجمالي التكلفة | $0.000 | $0.104 |
| ??? ??????? | $0.000 / 1M | $2.500 / 1M |
| ??? ??????? | $0.000 / 1M | $15.000 / 1M |
| رموز الإخراج | 1,639 | 2,317 |
| رموز الاستدلال | 89,199 | 0 |
| زمن الاستجابة (المتوسط) | 36.47s | 1.51s |
| زمن الاستجابة (الحد الأقصى) | 309.02s | 2.95s |
| زمن الاستجابة (الإجمالي) | 656.47s | 27.21s |
الدرجة مقابل التكلفة الإجمالية
زمن الاستجابة (المتوسط)
النتيجة vs زمن الاستجابة (المتوسط)
إجمالي رموز الإخراج
النتيجة vs إجمالي رموز الإخراج
تفصيل الفئات
مقارنة سريعة
تبديل زوج المقارنة
Cobuddymediumمتاح مجانًاvsOwl AlphanoneCobuddymediumمتاح مجانًاvsMiMo-V2-PrononeCobuddymediumمتاح مجانًاvsGLM 4.7 FlashnoneCobuddymediumمتاح مجانًاvsQwen3.5-27BnoneCobuddymediumمتاح مجانًاvsQwen3.6 27BnoneCobuddymediumمتاح مجانًاvsQwen3.5-35B-A3BnoneCobuddymediumمتاح مجانًاvsKimi K2.6noneCobuddymediumمتاح مجانًاvsGLM 5.1noneCobuddymediumمتاح مجانًاvsQwen3.5 Plus 2026-04-20noneCobuddymediumمتاح مجانًاvsDeepSeek V3.2noneCobuddymediumمتاح مجانًاvsMiMo-V2.5-PrononeCobuddymediumمتاح مجانًاvsQwen3.6 Flashnone