قارن الرسوم البيانية المنهجية

اللغة:

❤️ Made by XCS

AI BENCHY Compare

Trinity Large Preview vs OpenAI: GPT-5 Mini

قارن:

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-03-06

المقياس	Trinity Large Preview none الإصدار: 2026-01-27 متاح مجانًا	OpenAI: GPT-5 Mini medium الإصدار: 2025-08-07
الترتيب	#45	#32
متوسط الدرجة	4.2	6.0
الاتساق	9.6	8.9
التكلفة لكل نتيجة	0.000	1.457
إجمالي التكلفة	$0.000	$0.117
اختبارات صحيحة
معدل النجاح لكل محاولة	33.3%	58.3%
اختبارات غير مستقرة	1	2
إجمالي مرات التشغيل	48	48
رموز الإخراج	1,837	5,826
رموز الاستدلال	0	48,768
زمن الاستجابة (المتوسط)	3.15s	25.14s
زمن الاستجابة (الحد الأقصى)	8.91s	88.15s
زمن الاستجابة (الإجمالي)	50.46s	402.29s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

متوسط الدرجة vs زمن الاستجابة (المتوسط)

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Trinity Large Preview	10.0	10.0	0.0%	0		3.59s	587	0
OpenAI: GPT-5 Mini	7.0	9.6	66.7%	0		16.45s	1,645	5,824

مجمّع	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Trinity Large Preview	10.0	10.0	0.0%	0		8.91s	294	0
OpenAI: GPT-5 Mini	10.0	10.0	100.0%	0		88.15s	754	11,520

تحليل البيانات واستخراجها	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Trinity Large Preview	9.9	10.0	100.0%	0		3.26s	186	0
OpenAI: GPT-5 Mini	9.9	10.0	100.0%	0		12.58s	453	3,200

خاص بالمجال	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Trinity Large Preview	4.0	10.0	33.3%	0		877ms	25	0
OpenAI: GPT-5 Mini	10.0	7.2	22.2%	1		44.63s	293	14,016

الذكاء العام	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Trinity Large Preview	3.0	9.9	0.0%	0		2.86s	124	0
OpenAI: GPT-5 Mini	4.0	10.0	0.0%	0		13.50s	349	1,856

اتباع التعليمات	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Trinity Large Preview	3.5	6.7	16.7%	1		1.09s	63	0
OpenAI: GPT-5 Mini	7.5	6.6	83.3%	1		15.66s	318	4,992

Puzzle Solving	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Trinity Large Preview	4.0	10.0	33.3%	0		3.30s	291	0
OpenAI: GPT-5 Mini	4.3	9.8	33.3%	0		14.09s	1,527	5,760

استدعاء الأدوات	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Trinity Large Preview	10.0	10.0	100.0%	0		6.67s	267	0
OpenAI: GPT-5 Mini	10.0	10.0	100.0%	0		18.64s	487	1,600

مقارنة سريعة

تبديل زوج المقارنة

GPT-5 MinimediumvsGLM 5none GPT-5 MinimediumvsQwen3.5 Plus 2026-02-15none DeepSeek V3.2nonevsGPT-5 Minimedium Trinity Large Previewnoneمتاح مجانًاvsMiniMax M2.5medium Trinity Large Previewnoneمتاح مجانًاvsQwen3 Coder Nextmedium GPT-5 MinimediumvsQwen3.5-Flashnone Gemini 2.5 FlashnonevsGPT-5 Minimedium Claude Sonnet 4.6nonevsGPT-5 Minimedium Trinity Large Previewnoneمتاح مجانًاvsgpt-oss-120bmediumمتاح مجانًا GPT-5 MinimediumvsQwen3.5-122B-A10Bnone GPT-5 MinimediumvsQwen3.5-27Bnone Trinity Large Previewnoneمتاح مجانًاvsMercury 2medium