AI BENCHY Compare
Owl Alpha vs xAI: Grok 4.20
تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-05-10
| المقياس | Owl Alpha Owl Alpha none | Grok 4.20 Grok 4.20 none |
|---|---|---|
| النتيجة | 5.8 | 5.4 |
| الترتيب | #98 | #115 |
| الموثوقية | 10.0 | غير متاح |
| الاتساق | 9.1 | 9.5 |
| اختبارات صحيحة | ||
| معدل النجاح لكل محاولة | 43.9% | 35.2% |
| اختبارات غير مستقرة | 2 | 1 |
| إجمالي مرات التشغيل | 57 | 54 |
| التكلفة لكل نتيجة | 0.000 | 1.574 |
| إجمالي التكلفة | $0.000 | $0.095 |
| ??? ??????? | $0.000 / 1M | $1.250 / 1M |
| ??? ??????? | $0.000 / 1M | $2.500 / 1M |
| رموز الإخراج | 1,685 | 1,967 |
| رموز الاستدلال | 0 | 0 |
| زمن الاستجابة (المتوسط) | 6.83s | 1.11s |
| زمن الاستجابة (الحد الأقصى) | 32.27s | 6.04s |
| زمن الاستجابة (الإجمالي) | 129.73s | 20.02s |
الدرجة مقابل التكلفة الإجمالية
زمن الاستجابة (المتوسط)
النتيجة vs زمن الاستجابة (المتوسط)
إجمالي رموز الإخراج
النتيجة vs إجمالي رموز الإخراج
تفصيل الفئات
مقارنة سريعة
تبديل زوج المقارنة
Cobuddymediumمتاح مجانًاvsOwl AlphanoneElephant AlphamediumvsGrok 4.20nonegpt-oss-120bmediumمتاح مجانًاvsOwl AlphanoneMistral Small 4mediumvsGrok 4.20noneMiniMax M2.5mediumمتاح مجانًاvsGrok 4.20noneNemotron 3 Supermediumمتاح مجانًاvsOwl AlphanoneMiniMax M2.5mediumمتاح مجانًاvsOwl AlphanoneMistral Small 4mediumvsOwl AlphanoneMiniMax M2.7mediumvsGrok 4.20nonegpt-oss-120bmediumمتاح مجانًاvsGrok 4.20noneGPT-5 NanomediumvsOwl AlphanoneCobuddymediumمتاح مجانًاvsGrok 4.20none