التنقل
AI BENCHY
قارن الرسوم البيانية المنهجية
❤️ Made by XCS
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Trinity Large Preview vs Google: Gemini 3 Flash Preview

قارن:

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-03-06

المقياس Trinity Large Preview none الإصدار: 2026-01-27 متاح مجانًا Google: Gemini 3 Flash Preview medium الإصدار: 2025-12-17
الترتيب #45 #1
متوسط الدرجة 4.2 10.0
الاتساق 9.6 10.0
التكلفة لكل نتيجة 0.000 1.025
إجمالي التكلفة $0.000 $0.164
اختبارات صحيحة
معدل النجاح لكل محاولة 33.3% 100.0%
اختبارات غير مستقرة 1 0
إجمالي مرات التشغيل 48 (16 x 3) 48 (16 x 3)
رموز الإخراج 1,837 1,634
رموز الاستدلال 0 47,907
زمن الاستجابة (المتوسط) 3.15s 12.36s
زمن الاستجابة (الحد الأقصى) 8.91s 50.16s
زمن الاستجابة (الإجمالي) 50.46s 111.21s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

متوسط الدرجة vs زمن الاستجابة (المتوسط)

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Trinity Large Preview 10.0 10.0 0.0% 0 3.59s 587 0
Google: Gemini 3 Flash Preview 10.0 10.0 100.0% 0 5.61s 299 3,127
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Trinity Large Preview 10.0 10.0 0.0% 0 8.91s 294 0
Google: Gemini 3 Flash Preview 10.0 10.0 100.0% 0 50.16s 351 12,645
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Trinity Large Preview 9.9 10.0 100.0% 0 3.26s 186 0
Google: Gemini 3 Flash Preview 9.9 10.0 100.0% 0 4.72s 279 5,333
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Trinity Large Preview 4.0 10.0 33.3% 0 877ms 25 0
Google: Gemini 3 Flash Preview 10.0 10.0 100.0% 0 21.12s 12 14,908
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Trinity Large Preview 3.0 9.9 0.0% 0 2.86s 124 0
Google: Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.09s 111 1,285
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Trinity Large Preview 3.5 6.7 16.7% 1 1.09s 63 0
Google: Gemini 3 Flash Preview 10.0 10.0 100.0% 0 6.10s 72 4,558
Puzzle Solving النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Trinity Large Preview 4.0 10.0 33.3% 0 3.30s 291 0
Google: Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.43s 276 4,921
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Trinity Large Preview 10.0 10.0 100.0% 0 6.67s 267 0
Google: Gemini 3 Flash Preview 10.0 10.0 100.0% 0 10.55s 234 1,130

مقارنة سريعة

تبديل زوج المقارنة