التنقل
AI BENCHY
Your ad here

AI BENCHY Compare

OpenAI: GPT-5 Nano vs Owl Alpha

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-04-30

المقياس GPT-5 Nano GPT-5 Nano medium الإصدار: 2025-08-07 Owl Alpha Owl Alpha none الإصدار: 2026-04-30
النتيجة 6.4 6.0
الترتيب #73 #87
الموثوقية غير متاح 10.0
الاتساق 6.8 9.1
اختبارات صحيحة
معدل النجاح لكل محاولة 61.1% 46.3%
اختبارات غير مستقرة 7 2
إجمالي مرات التشغيل 54 54
التكلفة لكل نتيجة 0.824 0.000
إجمالي التكلفة $0.066 $0.000
??? ??????? $0.050 / 1M $0.000 / 1M
??? ??????? $0.400 / 1M $0.000 / 1M
رموز الإخراج 4,980 1,671
رموز الاستدلال 156,288 0
زمن الاستجابة (المتوسط) 44.13s 7.07s
زمن الاستجابة (الحد الأقصى) 204.02s 32.27s
زمن الاستجابة (الإجمالي) 485.47s 127.23s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
GPT-5 Nano 6.5 7.9 58.3% 1 25.50s 1,221 21,184
Owl Alpha 3.4 7.9 16.7% 1 2.78s 57 0
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
GPT-5 Nano 6.7 3.5 66.7% 1 40.73s 480 12,992
Owl Alpha 10.0 10.0 100.0% 0 32.27s 450 0
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
GPT-5 Nano 10.0 10.0 100.0% 0 65.96s 578 17,984
Owl Alpha 3.0 10.0 0.0% 0 21.74s 315 0
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
GPT-5 Nano 3.7 1.7 50.0% 2 21.42s 453 10,560
Owl Alpha 10.0 10.0 100.0% 0 3.60s 246 0
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
GPT-5 Nano 5.2 4.4 55.6% 2 204.02s 237 64,448
Owl Alpha 5.3 10.0 33.3% 0 3.00s 27 0
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
GPT-5 Nano 4.1 10.0 0.0% 0 17.51s 202 4,608
Owl Alpha 4.3 10.0 0.0% 0 4.61s 80 0
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
GPT-5 Nano 9.8 10.0 100.0% 0 11.90s 382 4,096
Owl Alpha 6.4 10.0 50.0% 0 2.63s 63 0
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
GPT-5 Nano 5.3 7.2 44.4% 1 19.81s 869 13,440
Owl Alpha 5.9 7.2 55.6% 1 4.43s 202 0
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
GPT-5 Nano 10.0 10.0 100.0% 0 33.30s 558 6,976
Owl Alpha 10.0 10.0 100.0% 0 22.78s 231 0

مقارنة سريعة

تبديل زوج المقارنة