التنقل
Advertise here

GPT 5.3 Chat (default) vs GLM 5.2

متوسط النتيجة متقارب جدًا عند 6.7 مقابل 6.6. لدى GLM 5.2 تكلفة benchmark أقل عند $0.250 مقابل $0.533. GPT 5.3 Chat (default) أسرع عند 6.31s مقابل 11.27s، مع معدلات نجاح 62.3% مقابل 63.8%.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-10-07

النماذج المقارنة

الترتيب
#193
إجمالي رموز الإخراج
28,179
زمن الاستجابة (المتوسط)
6.31s
إجمالي التكلفة
$0.533
الترتيب
#198
إجمالي رموز الإخراج
17,685
زمن الاستجابة (المتوسط)
11.27s
إجمالي التكلفة
$0.250
النموذج الموصى به GLM 5.2

It has the best score here (6.6), while costing about 2.1x less than GPT 5.3 Chat (default).

مقارنة تفصيلية

المقياس GPT 5.3 Chat GPT 5.3 Chat default الإصدار: 2026-03-03 GLM 5.2 GLM 5.2 none الإصدار: 2026-06-17
النتيجة 6.7 6.6
الترتيب #193 #198
الموثوقية 10.0 10.0
الاتساق 8.6 9.0
محاولات 69/69 69/69
اختبارات صحيحة
معدل النجاح لكل محاولة 62.3% 63.8%
اختبارات غير مستقرة 4 3
إجمالي مرات التشغيل 69 69
التكلفة لكل نتيجة 4.097 1.753
إجمالي التكلفة $0.533 $0.250
سعر الإدخال $1.750 / 1M $0.153 / 1M
سعر الإخراج $14.000 / 1M $12.000 / 1M
سعر قراءة ذاكرة التخزين المؤقت غير متاح $0.150 / 1M
سعر الكتابة في ذاكرة التخزين المؤقت غير متاح غير متاح
إجمالي رموز الإدخال 78,846 247,919
رموز الإخراج 7,635 17,685
رموز الاستدلال 20,544 0
زمن الاستجابة (المتوسط) 6.31s 11.27s
زمن الاستجابة (الحد الأقصى) 18.33s 79.65s
زمن الاستجابة (الإجمالي) 138.73s 259.32s
المعلمات ~400B الإجمالي (~17B النشطة) 744B الإجمالي (40B النشطة)
الإتاحة مغلق المصدر مفتوح المصدر

تنطبق أسعار التخزين المؤقت على رموز الإدخال. تعيد القراءة استخدام المطالبات المخزنة؛ وتحفظها الكتابة وقد تكلّف أكثر. تُحاسب رموز الإخراج بسعر الإخراج.

عرض إنشاء النماذج

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#193 GPT 5.3 Chat

default
التكلفة
$0.008
الوقت
8.1s
الرموز
634 tok

#198 GLM 5.2

none
التكلفة
$0.033
الوقت
87.7s
الرموز
7,455 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
GPT 5.3 Chat 5.6 4.7 55.6% 2 10.52s 7,302 808 5,824
GLM 5.2 3.7 9.5 0.0% 0 7.55s 7,263 1,958 0

تبديل زوج المقارنة