التنقل
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Poolside: Laguna XS 2.1 vs Z.ai: GLM 5

الملخص

مقارنة benchmark بين Laguna XS 2.1 و GLM 5: يتقدم GLM 5 في متوسط النتيجة بـ 6.0 مقابل 5.3. لدى Laguna XS 2.1 تكلفة benchmark أقل عند $0.003 مقابل $0.027. Laguna XS 2.1 أسرع عند 722ms مقابل 4.03s، مع معدلات نجاح 31.8% مقابل 44.4%.

النموذج الموصى به: GLM 5 - It has the strongest score in this comparison (6.0) and the best overall balance of cost and response time across all 2 models.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-07-02

المقياس Laguna XS 2.1 Laguna XS 2.1 none الإصدار: 2026-07-02 متاح مجانًا GLM 5 GLM 5 none الإصدار: 2026-02-12
النتيجة 5.3 6.0
الترتيب #128 #104
الموثوقية 10.0 10.0
الاتساق 9.0 9.7
اختبارات صحيحة
معدل النجاح لكل محاولة 31.8% 44.4%
اختبارات غير مستقرة 3 1
إجمالي مرات التشغيل 63 63
التكلفة لكل نتيجة 0.058 0.263
إجمالي التكلفة $0.003 $0.027
سعر الإدخال $0.060 / 1M $0.600 / 1M
سعر الإخراج $0.120 / 1M $1.920 / 1M
إجمالي رموز الإدخال 41,148 37,135
رموز الإخراج 3,451 1,989
رموز الاستدلال 0 0
زمن الاستجابة (المتوسط) 722ms 4.03s
زمن الاستجابة (الحد الأقصى) 2.30s 11.07s
زمن الاستجابة (الإجمالي) 15.17s 56.37s

عرض إنشاء

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#128 Laguna XS 2.1

none
التكلفة
$0.001
الوقت
27.6s
الرموز
4,344 tok

#104 GLM 5

none
التكلفة
$0.007
الوقت
32.1s
الرموز
2,023 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Laguna XS 2.1 5.3 8.3 33.3% 1 755ms 774 1,015 0
GLM 5 4.8 10.0 25.0% 0 2.37s 510 275 0
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Laguna XS 2.1 4.3 7.8 22.2% 1 623ms 7,995 562 0
GLM 5 4.0 7.8 11.1% 1 5.12s 7,256 428 0
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Laguna XS 2.1 3.0 10.0 0.0% 0 1.76s 14,197 402 0
GLM 5 3.0 10.0 0.0% 0 4.98s 12,812 406 0
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Laguna XS 2.1 10.0 10.0 100.0% 0 768ms 7,734 240 0
GLM 5 10.0 10.0 100.0% 0 5.78s 7,107 203 0
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Laguna XS 2.1 5.3 10.0 33.3% 0 364ms 834 14 0
GLM 5 3.0 10.0 0.0% 0 2.24s 643 19 0
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Laguna XS 2.1 5.0 10.0 0.0% 0 529ms 537 128 0
GLM 5 10.0 10.0 100.0% 0 3.27s 477 103 0
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Laguna XS 2.1 3.8 5.8 33.3% 1 364ms 638 50 0
GLM 5 10.0 10.0 100.0% 0 1.48s 636 61 0
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Laguna XS 2.1 3.0 10.0 0.0% 0 1.01s 771 730 0
GLM 5 7.7 10.0 66.7% 0 1.91s 609 261 0
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Laguna XS 2.1 10.0 10.0 100.0% 0 1.36s 7,413 300 0
GLM 5 10.0 10.0 100.0% 0 11.07s 6,899 220 0
معلومات عامة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Laguna XS 2.1 3.0 10.0 0.0% 0 254ms 255 10 0
GLM 5 3.0 10.0 0.0% 0 3.62s 186 13 0

مقارنة سريعة

تبديل زوج المقارنة