التنقل
AI BENCHY
Advertise here

AI BENCHY Compare

Google: Gemini 3.5 Flash vs StepFun: Step 3.5 Flash

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-06-03

المقياس Gemini 3.5 Flash Gemini 3.5 Flash high الإصدار: 2026-05-19 Step 3.5 Flash Step 3.5 Flash medium الإصدار: 2026-02-01
النتيجة 9.6 7.4
الترتيب #2 #55
الموثوقية 10.0 10.0
الاتساق 9.6 9.4
اختبارات صحيحة
معدل النجاح لكل محاولة 96.7% 59.7%
اختبارات غير مستقرة 1 1
إجمالي مرات التشغيل 60 57
التكلفة لكل نتيجة 5.231 0.133
إجمالي التكلفة $0.994 $0.062
سعر الإدخال $1.500 / 1M $0.090 / 1M
سعر الإخراج $9.000 / 1M $0.300 / 1M
إجمالي رموز الإدخال 34,591 33,555
رموز الإخراج 1,969 90,478
رموز الاستدلال 102,679 173,544
زمن الاستجابة (المتوسط) 8.30s 43.20s
زمن الاستجابة (الحد الأقصى) 34.82s 170.45s
زمن الاستجابة (الإجمالي) 165.92s 561.54s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.57s 492 174 4,997
Step 3.5 Flash 10.0 10.0 100.0% 0 40.57s 694 20,391 24,176
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemini 3.5 Flash 10.0 10.0 100.0% 0 24.62s 5,115 450 34,170
Step 3.5 Flash 3.5 7.8 0.0% 0 62.83s 1,335 12,098 0
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemini 3.5 Flash 10.0 10.0 100.0% 0 22.37s 12,873 351 16,323
Step 3.5 Flash 10.0 10.0 100.0% 0 29.57s 13,638 1,176 12,984
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemini 3.5 Flash 10.0 10.0 100.0% 0 6.43s 7,548 279 8,466
Step 3.5 Flash 10.0 10.0 100.0% 0 15.01s 7,368 600 13,886
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemini 3.5 Flash 7.6 7.2 77.8% 1 14.09s 633 12 24,721
Step 3.5 Flash 5.3 7.2 44.4% 1 170.45s 673 45,350 90,436
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.63s 486 115 1,650
Step 3.5 Flash 5.5 10.0 0.0% 0 22.39s 509 240 3,506
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.35s 615 70 3,799
Step 3.5 Flash 8.3 10.0 50.0% 0 4.78s 705 2,364 3,521
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.23s 558 241 4,940
Step 3.5 Flash 5.3 10.0 33.3% 0 7.22s 711 5,630 10,861
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemini 3.5 Flash 9.8 10.0 100.0% 0 4.96s 6,115 265 1,608
Step 3.5 Flash 10.0 10.0 100.0% 0 11.91s 7,701 275 3,802
معلومات عامة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.94s 156 12 2,005
Step 3.5 Flash 3.0 10.0 0.0% 0 108.45s 221 2,354 10,372

مقارنة سريعة

تبديل زوج المقارنة