AI BENCHY Compare

Trinity Large Preview vs Qwen: Qwen3.5-122B-A10B

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-06-03

المقياس	Trinity Large Preview Trinity Large Preview none الإصدار: 2026-01-27	Qwen3.5-122B-A10B Qwen3.5-122B-A10B none الإصدار: 2026-02-24

المقياس	Trinity Large Preview Trinity Large Preview none الإصدار: 2026-01-27	Qwen3.5-122B-A10B Qwen3.5-122B-A10B none الإصدار: 2026-02-24
النتيجة	4.7	5.4
الترتيب	#148	#131
الموثوقية	10.0	10.0
الاتساق	9.3	9.5
اختبارات صحيحة
معدل النجاح لكل محاولة	23.3%	33.3%
اختبارات غير مستقرة	2	1
إجمالي مرات التشغيل	60	60
التكلفة لكل نتيجة	0.017	0.380
إجمالي التكلفة	$0.008	$0.019
سعر الإدخال	$0.243 / 1M	$0.260 / 1M
سعر الإخراج	$0.243 / 1M	$2.080 / 1M
إجمالي رموز الإدخال	29,828	44,894
رموز الإخراج	2,169	3,374
رموز الاستدلال	0	0
زمن الاستجابة (المتوسط)	2.98s	3.38s
زمن الاستجابة (الحد الأقصى)	14.34s	46.00s
زمن الاستجابة (الإجمالي)	56.57s	67.55s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Trinity Large Preview	3.1	10.0	0.0%	0		2.07s	651	550	0
Qwen3.5-122B-A10B	4.8	10.0	25.0%	0		1.59s	696	312	0

البرمجة	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Trinity Large Preview	4.0	6.6	16.7%	1		14.34s	738	397	0
Qwen3.5-122B-A10B	4.0	5.5	33.3%	1		2.14s	5,072	684	0

مجمّع	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Trinity Large Preview	3.0	10.0	0.0%	0		8.91s	12,053	294	0
Qwen3.5-122B-A10B	3.0	10.0	0.0%	0		46.00s	20,175	1,137	0

تحليل البيانات واستخراجها	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Trinity Large Preview	10.0	10.0	100.0%	0		3.26s	6,900	186	0
Qwen3.5-122B-A10B	10.0	10.0	100.0%	0		1.01s	7,794	243	0

خاص بالمجال	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Trinity Large Preview	5.3	10.0	33.3%	0		877ms	738	25	0
Qwen3.5-122B-A10B	5.3	10.0	33.3%	0		465ms	789	15	0

الذكاء العام	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Trinity Large Preview	4.5	10.0	0.0%	0		873ms	498	104	0
Qwen3.5-122B-A10B	5.0	10.0	0.0%	0		1.12s	522	66	0

اتباع التعليمات	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Trinity Large Preview	3.5	10.0	0.0%	0		822ms	678	63	0
Qwen3.5-122B-A10B	6.3	10.0	50.0%	0		513ms	711	69	0

حل الألغاز	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Trinity Large Preview	3.6	7.7	11.1%	1		1.97s	669	265	0
Qwen3.5-122B-A10B	3.8	10.0	0.0%	0		1.00s	714	575	0

استدعاء الأدوات	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Trinity Large Preview	10.0	10.0	100.0%	0		6.67s	6,699	267	0
Qwen3.5-122B-A10B	10.0	10.0	100.0%	0		2.04s	8,211	264	0

معلومات عامة	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Trinity Large Preview	3.0	10.0	0.0%	0		777ms	204	18	0
Qwen3.5-122B-A10B	3.0	10.0	0.0%	0		295ms	210	9	0

مقارنة سريعة

تبديل زوج المقارنة

Trinity Large PreviewnonevsQwen3 Coder Nextmedium Mistral Small 4mediumvsQwen3.5-122B-A10Bnone MiniMax M2.7mediumvsQwen3.5-122B-A10Bnone Elephant AlphamediumvsQwen3.5-122B-A10Bnone MiniMax M2.5mediumvsQwen3.5-122B-A10Bnone Trinity Large PreviewnonevsGLM 4.7 Flashmedium CobuddymediumvsQwen3.5-122B-A10Bnone Trinity Large PreviewnonevsQwen3.5-9Bmedium Owl AlphamediumvsQwen3.5-122B-A10Bnone Trinity Large PreviewnonevsElephant Alphamedium gpt-oss-120bmediumمتاح مجانًاvsQwen3.5-122B-A10Bnone Nemotron 3 Supermediumمتاح مجانًاvsQwen3.5-122B-A10Bnone