التنقل
AI BENCHY
Advertise here

AI BENCHY Compare

Trinity Large Preview vs Google: Gemini 3.5 Flash

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-06-03

المقياس Trinity Large Preview Trinity Large Preview none الإصدار: 2026-01-27 Gemini 3.5 Flash Gemini 3.5 Flash low الإصدار: 2026-05-19
النتيجة 4.7 9.3
الترتيب #148 #3
الموثوقية 10.0 10.0
الاتساق 9.3 10.0
اختبارات صحيحة
معدل النجاح لكل محاولة 23.3% 90.0%
اختبارات غير مستقرة 2 0
إجمالي مرات التشغيل 60 60
التكلفة لكل نتيجة 0.017 1.582
إجمالي التكلفة $0.008 $0.285
سعر الإدخال $0.243 / 1M $1.500 / 1M
سعر الإخراج $0.243 / 1M $9.000 / 1M
إجمالي رموز الإدخال 29,828 33,935
رموز الإخراج 2,169 2,027
رموز الاستدلال 0 23,938
زمن الاستجابة (المتوسط) 2.98s 2.98s
زمن الاستجابة (الحد الأقصى) 14.34s 6.44s
زمن الاستجابة (الإجمالي) 56.57s 59.59s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Trinity Large Preview 3.1 10.0 0.0% 0 2.07s 651 550 0
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.52s 494 209 2,536
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Trinity Large Preview 4.0 6.6 16.7% 1 14.34s 738 397 0
Gemini 3.5 Flash 6.8 10.0 50.0% 0 5.54s 5,115 452 6,839
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Trinity Large Preview 3.0 10.0 0.0% 0 8.91s 12,053 294 0
Gemini 3.5 Flash 10.0 10.0 100.0% 0 6.44s 12,873 351 3,050
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Trinity Large Preview 10.0 10.0 100.0% 0 3.26s 6,900 186 0
Gemini 3.5 Flash 10.0 10.0 100.0% 0 1.81s 7,548 279 1,164
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Trinity Large Preview 5.3 10.0 33.3% 0 877ms 738 25 0
Gemini 3.5 Flash 7.7 10.0 66.7% 0 3.39s 633 12 4,538
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Trinity Large Preview 4.5 10.0 0.0% 0 873ms 498 104 0
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.27s 486 119 916
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Trinity Large Preview 3.5 10.0 0.0% 0 822ms 678 63 0
Gemini 3.5 Flash 9.9 10.0 100.0% 0 1.86s 615 71 1,652
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Trinity Large Preview 3.6 7.7 11.1% 1 1.97s 669 265 0
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.35s 558 288 2,150
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Trinity Large Preview 10.0 10.0 100.0% 0 6.67s 6,699 267 0
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.27s 5,457 234 403
معلومات عامة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Trinity Large Preview 3.0 10.0 0.0% 0 777ms 204 18 0
Gemini 3.5 Flash 10.0 10.0 100.0% 0 1.88s 156 12 690

مقارنة سريعة

تبديل زوج المقارنة