التنقل
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Inception: Mercury 2 vs inclusionAI: Ling-2.6-flash

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-06-03

المقياس Mercury 2 Mercury 2 none الإصدار: 2026-02-24 Ling-2.6-flash Ling-2.6-flash none الإصدار: 2026-04-21
النتيجة 4.6 5.2
الترتيب #153 #135
الموثوقية 10.0 10.0
الاتساق 9.1 9.2
اختبارات صحيحة
معدل النجاح لكل محاولة 25.0% 33.3%
اختبارات غير مستقرة 2 2
إجمالي مرات التشغيل 60 60
التكلفة لكل نتيجة 0.216 0.005
إجمالي التكلفة $0.009 $0.001
سعر الإدخال $0.250 / 1M $0.010 / 1M
سعر الإخراج $0.750 / 1M $0.030 / 1M
إجمالي رموز الإدخال 25,515 40,718
رموز الإخراج 3,001 2,878
رموز الاستدلال 0 0
زمن الاستجابة (المتوسط) 614ms 9.34s
زمن الاستجابة (الحد الأقصى) 1.27s 35.34s
زمن الاستجابة (الإجمالي) 12.28s 177.48s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Mercury 2 3.0 10.0 0.0% 0 483ms 631 286 0
Ling-2.6-flash 6.8 8.1 58.3% 1 11.81s 726 573 0
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Mercury 2 3.5 9.4 0.0% 0 831ms 4,631 1,650 0
Ling-2.6-flash 6.5 10.0 50.0% 0 11.21s 813 381 0
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Mercury 2 3.0 10.0 0.0% 0 606ms 4,821 131 0
Ling-2.6-flash 3.0 10.0 0.0% 0 35.34s 20,818 1,069 0
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Mercury 2 7.3 5.9 83.3% 1 667ms 6,362 180 0
Ling-2.6-flash 6.5 10.0 50.0% 0 8.48s 8,004 246 0
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Mercury 2 5.3 7.2 44.4% 1 534ms 784 46 0
Ling-2.6-flash 3.0 10.0 0.0% 0 4.95s 810 24 0
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Mercury 2 4.8 10.0 0.0% 0 628ms 495 159 0
Ling-2.6-flash 4.0 10.0 0.0% 0 1.45s 540 109 0
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Mercury 2 6.5 10.0 50.0% 0 551ms 691 82 0
Ling-2.6-flash 9.8 10.0 100.0% 0 5.52s 732 81 0
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Mercury 2 3.1 10.0 0.0% 0 535ms 694 251 0
Ling-2.6-flash 2.9 7.2 11.1% 1 6.51s 729 151 0
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Mercury 2 10.0 10.0 100.0% 0 1.27s 6,193 197 0
Ling-2.6-flash 3.0 10.0 0.0% 0 18.80s 7,324 229 0
معلومات عامة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Mercury 2 3.0 10.0 0.0% 0 548ms 213 19 0
Ling-2.6-flash 3.0 10.0 0.0% 0 1.06s 222 15 0

مقارنة سريعة

تبديل زوج المقارنة