التنقل
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

StepFun: Step 3.7 Flash vs Z.ai: GLM 5.2

الملخص

مقارنة benchmark بين Step 3.7 Flash و GLM 5.2: متوسط النتيجة متقارب جدًا عند 7.1 مقابل 7.1. لدى GLM 5.2 تكلفة benchmark أقل عند $0.076 مقابل $1.148. GLM 5.2 أسرع عند 6.34s مقابل 64.46s، مع معدلات نجاح 63.5% مقابل 60.3%.

النموذج الموصى به: GLM 5.2 - It has the best score here (7.1), while costing about 15.2x less than Step 3.7 Flash.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-06-17

المقياس Step 3.7 Flash Step 3.7 Flash high الإصدار: 2026-05-29 GLM 5.2 GLM 5.2 none الإصدار: 2026-06-17
النتيجة 7.1 7.1
الترتيب #63 #61
الموثوقية 10.0 9.9
الاتساق 8.2 9.6
اختبارات صحيحة
معدل النجاح لكل محاولة 63.5% 60.3%
اختبارات غير مستقرة 4 1
إجمالي مرات التشغيل 63 63
التكلفة لكل نتيجة 10.434 0.628
إجمالي التكلفة $1.148 $0.076
سعر الإدخال $0.200 / 1M $1.400 / 1M
سعر الإخراج $1.150 / 1M $4.400 / 1M
إجمالي رموز الإدخال 38,391 38,671
رموز الإخراج 991,355 4,817
رموز الاستدلال 0 0
زمن الاستجابة (المتوسط) 64.46s 6.34s
زمن الاستجابة (الحد الأقصى) 364.99s 20.69s
زمن الاستجابة (الإجمالي) 1353.57s 133.19s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#63 Step 3.7 Flash

high
Cost
$0.007
Time
63.6s
Tokens
6,030 tok

#61 GLM 5.2

none
Invalid SVG
Cost
$0.033
Time
87.7s
Tokens
7,455 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Step 3.7 Flash 10.0 10.0 100.0% 0 13.40s 696 42,656 0
GLM 5.2 8.3 10.0 75.0% 0 3.70s 567 313 0
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Step 3.7 Flash 4.0 6.0 22.2% 1 206.21s 6,057 327,340 0
GLM 5.2 3.7 9.5 0.0% 0 7.55s 7,263 1,958 0
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Step 3.7 Flash 10.0 10.0 100.0% 0 13.01s 13,638 8,802 0
GLM 5.2 10.0 10.0 100.0% 0 20.69s 14,296 1,489 0
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Step 3.7 Flash 10.0 10.0 100.0% 0 14.72s 7,368 23,113 0
GLM 5.2 10.0 10.0 100.0% 0 7.17s 7,113 204 0
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Step 3.7 Flash 4.1 4.4 44.5% 2 149.64s 783 410,502 0
GLM 5.2 5.3 10.0 33.3% 0 6.50s 696 27 0
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Step 3.7 Flash 5.5 10.0 0.0% 0 4.17s 510 2,862 0
GLM 5.2 6.1 3.1 66.7% 1 4.42s 480 82 0
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Step 3.7 Flash 9.8 10.0 100.0% 0 1.52s 705 2,010 0
GLM 5.2 9.8 10.0 100.0% 0 3.84s 642 66 0
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Step 3.7 Flash 5.3 7.2 44.4% 1 10.22s 711 25,422 0
GLM 5.2 7.7 10.0 66.7% 0 3.31s 618 265 0
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Step 3.7 Flash 10.0 10.0 100.0% 0 2.79s 7,701 1,172 0
GLM 5.2 10.0 10.0 100.0% 0 15.76s 6,807 400 0
معلومات عامة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Step 3.7 Flash 3.0 10.0 0.0% 0 149.34s 222 147,476 0
GLM 5.2 3.0 10.0 0.0% 0 3.41s 189 13 0

مقارنة سريعة

تبديل زوج المقارنة