التنقل
AI BENCHY
Advertise here

AI BENCHY Compare

StepFun: Step 3.7 Flash vs Z.ai: GLM 5 Turbo

الملخص

مقارنة benchmark بين Step 3.7 Flash و GLM 5 Turbo: يتقدم Step 3.7 Flash في متوسط النتيجة بـ 8.5 مقابل 8.4. لدى GLM 5 Turbo تكلفة benchmark أقل عند $0.323 مقابل $0.376. Step 3.7 Flash أسرع عند 20.35s مقابل 23.00s، مع معدلات نجاح 73.0% مقابل 74.6%.

النموذج الموصى به: GLM 5 Turbo - It offers the best overall trade-off: a competitive score (8.4), lower cost than Step 3.7 Flash, and balanced response time.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-06-12

المقياس Step 3.7 Flash Step 3.7 Flash medium الإصدار: 2026-05-29 GLM 5 Turbo GLM 5 Turbo medium الإصدار: 2026-03-15
النتيجة 8.5 8.4
الترتيب #23 #24
الموثوقية 9.9 10.0
الاتساق 9.3 8.5
اختبارات صحيحة
معدل النجاح لكل محاولة 73.0% 74.6%
اختبارات غير مستقرة 2 4
إجمالي مرات التشغيل 61 63
التكلفة لكل نتيجة 2.686 2.011
إجمالي التكلفة $0.376 $0.323
سعر الإدخال $0.200 / 1M $1.200 / 1M
سعر الإخراج $1.150 / 1M $4.000 / 1M
إجمالي رموز الإدخال 39,981 35,593
رموز الإخراج 319,958 12,245
رموز الاستدلال 0 62,277
زمن الاستجابة (المتوسط) 20.35s 23.00s
زمن الاستجابة (الحد الأقصى) 113.98s 194.23s
زمن الاستجابة (الإجمالي) 427.42s 482.97s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#23 Step 3.7 Flash

medium
Cost
$0.006
Time
46.2s
Tokens
4,466 tok

#24 GLM 5 Turbo

medium
Cost
$0.074
Time
206.0s
Tokens
18,549 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Step 3.7 Flash 8.7 7.9 91.7% 1 9.65s 756 32,185 0
GLM 5 Turbo 10.0 10.0 100.0% 0 4.82s 555 362 3,137
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Step 3.7 Flash 8.8 7.8 88.9% 1 27.42s 7,437 44,797 0
GLM 5 Turbo 8.2 9.3 66.7% 0 45.90s 5,941 363 25,381
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Step 3.7 Flash 10.0 10.0 100.0% 0 9.06s 13,683 7,106 0
GLM 5 Turbo 10.0 10.0 100.0% 0 13.88s 12,714 390 2,037
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Step 3.7 Flash 10.0 10.0 100.0% 0 2.75s 7,398 3,020 0
GLM 5 Turbo 10.0 10.0 100.0% 0 6.19s 7,107 577 3,632
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Step 3.7 Flash 7.7 10.0 66.7% 0 48.27s 708 70,347 0
GLM 5 Turbo 2.9 4.4 22.2% 2 71.07s 489 9,665 19,279
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Step 3.7 Flash 4.0 10.0 0.0% 0 6.85s 525 3,987 0
GLM 5 Turbo 6.1 3.1 66.7% 1 10.05s 477 60 2,216
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Step 3.7 Flash 9.8 10.0 100.0% 0 1.83s 735 2,166 0
GLM 5 Turbo 10.0 10.0 100.0% 0 5.38s 636 255 2,183
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Step 3.7 Flash 5.7 9.9 33.3% 0 6.19s 756 15,071 0
GLM 5 Turbo 8.7 7.9 77.8% 1 5.23s 609 312 2,647
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Step 3.7 Flash 10.0 10.0 100.0% 0 4.16s 7,746 2,115 0
GLM 5 Turbo 10.0 10.0 100.0% 0 9.84s 6,879 241 446
معلومات عامة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Step 3.7 Flash 3.0 10.0 0.0% 0 113.98s 237 139,164 0
GLM 5 Turbo 3.0 10.0 0.0% 0 40.17s 186 20 1,319

مقارنة سريعة

تبديل زوج المقارنة