التنقل
AI BENCHY
قارن الرسوم البيانية
❤️ Made by XCS
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

OpenAI: GPT-5.3 Chat vs xAI: Grok 4.1 Fast

قارن:

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-03-03

المقياس OpenAI: GPT-5.3 Chat none الإصدار: 2026-03-03 xAI: Grok 4.1 Fast medium الإصدار: 2025-11-19
الترتيب #14 #24
متوسط الدرجة 7.27 6.29
الاتساق 8.26 8.20
التكلفة لكل نتيجة 2.835 0.532
إجمالي التكلفة $0.256 $0.043
اختبارات صحيحة
معدل النجاح لكل محاولة 73.8% 66.7%
اختبارات غير مستقرة 3 3
رموز الإخراج 16,339 793
رموز الاستدلال 0 74,056

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
OpenAI: GPT-5.3 Chat 7.33 7.49 77.8% 1 3,091 0
xAI: Grok 4.1 Fast 10.00 10.00 100.0% 0 102 4,021
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
OpenAI: GPT-5.3 Chat 9.88 10.00 100.0% 0 942 0
xAI: Grok 4.1 Fast 10.00 10.00 100.0% 0 180 5,472
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
OpenAI: GPT-5.3 Chat 1.00 4.41 33.3% 2 8,264 0
xAI: Grok 4.1 Fast 4.00 7.21 55.6% 1 12 40,547
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
OpenAI: GPT-5.3 Chat 8.50 9.99 50.0% 0 1,455 0
xAI: Grok 4.1 Fast 5.50 10.00 50.0% 0 48 3,151
Puzzle Solving النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
OpenAI: GPT-5.3 Chat 10.00 10.00 100.0% 0 1,726 0
xAI: Grok 4.1 Fast 4.67 7.20 44.4% 1 191 9,380
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
OpenAI: GPT-5.3 Chat 10.00 10.00 100.0% 0 861 0
xAI: Grok 4.1 Fast 1.00 1.62 33.3% 1 260 11,485

مقارنة سريعة

تبديل زوج المقارنة