التنقل
AI BENCHY
Advertise here

AI BENCHY Compare

Poolside: Laguna XS 2.1 vs Z.ai: GLM 5.2

الملخص

مقارنة benchmark بين Laguna XS 2.1 و GLM 5.2: يتقدم GLM 5.2 في متوسط النتيجة بـ 7.1 مقابل 7.0. لدى Laguna XS 2.1 تكلفة benchmark أقل عند $0.036 مقابل $0.051. GLM 5.2 أسرع عند 6.34s مقابل 30.08s، مع معدلات نجاح 44.4% مقابل 60.3%.

النموذج الموصى به: GLM 5.2 - It has the best score here (7.1), while responding about 4.7x faster than Laguna XS 2.1.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-07-02

المقياس Laguna XS 2.1 Laguna XS 2.1 medium الإصدار: 2026-07-02 متاح مجانًا GLM 5.2 GLM 5.2 none الإصدار: 2026-06-17
النتيجة 7.0 7.1
الترتيب #67 #63
الموثوقية 10.0 9.9
الاتساق 9.6 9.6
اختبارات صحيحة
معدل النجاح لكل محاولة 44.4% 60.3%
اختبارات غير مستقرة 1 1
إجمالي مرات التشغيل 63 63
التكلفة لكل نتيجة 0.392 0.628
إجمالي التكلفة $0.036 $0.051
سعر الإدخال $0.060 / 1M $0.930 / 1M
سعر الإخراج $0.120 / 1M $3.000 / 1M
إجمالي رموز الإدخال 45,324 38,671
رموز الإخراج 25,761 4,817
رموز الاستدلال 268,677 0
زمن الاستجابة (المتوسط) 30.08s 6.34s
زمن الاستجابة (الحد الأقصى) 155.23s 20.69s
زمن الاستجابة (الإجمالي) 631.77s 133.19s

عرض إنشاء

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#67 Laguna XS 2.1

medium
التكلفة
$0.001
الوقت
30.6s
الرموز
4,678 tok

#63 GLM 5.2

none
SVG غير صالح
التكلفة
$0.033
الوقت
87.7s
الرموز
7,455 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Laguna XS 2.1 4.8 10.0 25.0% 0 41.96s 774 353 73,090
GLM 5.2 8.3 10.0 75.0% 0 3.70s 567 313 0
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Laguna XS 2.1 5.5 10.0 33.3% 0 70.35s 7,995 23,767 83,258
GLM 5.2 3.7 9.5 0.0% 0 7.55s 7,263 1,958 0
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Laguna XS 2.1 9.6 10.0 100.0% 0 13.43s 18,033 507 5,908
GLM 5.2 10.0 10.0 100.0% 0 20.69s 14,296 1,489 0
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Laguna XS 2.1 10.0 10.0 100.0% 0 4.50s 7,734 234 3,129
GLM 5.2 10.0 10.0 100.0% 0 7.17s 7,113 204 0
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Laguna XS 2.1 2.9 7.2 11.1% 1 65.66s 834 17 91,533
GLM 5.2 5.3 10.0 33.3% 0 6.50s 696 27 0
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Laguna XS 2.1 5.0 10.0 0.0% 0 4.15s 537 119 1,375
GLM 5.2 6.1 3.1 66.7% 1 4.42s 480 82 0
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Laguna XS 2.1 9.8 10.0 100.0% 0 2.57s 753 82 1,844
GLM 5.2 9.8 10.0 100.0% 0 3.84s 642 66 0
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Laguna XS 2.1 5.3 10.0 33.3% 0 3.43s 771 357 3,355
GLM 5.2 7.7 10.0 66.7% 0 3.31s 618 265 0
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Laguna XS 2.1 10.0 10.0 100.0% 0 3.01s 7,638 309 748
GLM 5.2 10.0 10.0 100.0% 0 15.76s 6,807 400 0
معلومات عامة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Laguna XS 2.1 3.0 10.0 0.0% 0 10.88s 255 16 4,437
GLM 5.2 3.0 10.0 0.0% 0 3.41s 189 13 0

مقارنة سريعة

تبديل زوج المقارنة