AI BENCHY Compare

DeepSeek: DeepSeek V3.2 vs Qwen: Qwen3.5-Flash

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-06-01

المقياس	DeepSeek V3.2 DeepSeek V3.2 none الإصدار: 2025-12-01	Qwen3.5-Flash Qwen3.5-Flash none الإصدار: 2026-02-24

المقياس	DeepSeek V3.2 DeepSeek V3.2 none الإصدار: 2025-12-01	Qwen3.5-Flash Qwen3.5-Flash none الإصدار: 2026-02-24
النتيجة	5.6	5.9
الترتيب	#120	#104
الموثوقية	10.0	10.0
الاتساق	8.3	9.7
اختبارات صحيحة
معدل النجاح لكل محاولة	41.7%	41.7%
اختبارات غير مستقرة	6	1
إجمالي مرات التشغيل	60	60
التكلفة لكل نتيجة	0.222	0.073
إجمالي التكلفة	$0.018	$0.004
سعر الإدخال	$0.252 / 1M	$0.065 / 1M
سعر الإخراج	$0.378 / 1M	$0.260 / 1M
رموز الإخراج	11,159	4,270
رموز الاستدلال	0	0
زمن الاستجابة (المتوسط)	14.43s	3.74s
زمن الاستجابة (الحد الأقصى)	115.89s	27.18s
زمن الاستجابة (الإجمالي)	288.55s	74.71s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
DeepSeek V3.2	3.2	8.2	8.3%	1		9.35s	1,073	0
Qwen3.5-Flash	3.5	8.3	8.3%	1		1.32s	690	0

البرمجة	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
DeepSeek V3.2	3.1	5.4	16.7%	1		20.87s	4,522	0
Qwen3.5-Flash	6.8	10.0	50.0%	0		993ms	513	0

مجمّع	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
DeepSeek V3.2	6.5	10.0	0.0%	0		115.89s	2,887	0
Qwen3.5-Flash	3.0	10.0	0.0%	0		6.22s	1,794	0

تحليل البيانات واستخراجها	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
DeepSeek V3.2	6.3	5.8	66.7%	1		9.42s	1,710	0
Qwen3.5-Flash	10.0	10.0	100.0%	0		1.57s	243	0

خاص بالمجال	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
DeepSeek V3.2	2.9	6.9	11.1%	1		4.17s	21	0
Qwen3.5-Flash	7.7	10.0	66.7%	0		905ms	15	0

الذكاء العام	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
DeepSeek V3.2	6.8	10.0	66.7%	1		9.32s	43	0
Qwen3.5-Flash	10.0	10.0	100.0%	0		803ms	100	0

اتباع التعليمات	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
DeepSeek V3.2	10.0	10.0	100.0%	0		1.52s	66	0
Qwen3.5-Flash	6.3	10.0	50.0%	0		8.81s	63	0

حل الألغاز	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
DeepSeek V3.2	8.3	10.0	77.8%	1		6.91s	298	0
Qwen3.5-Flash	3.1	10.0	0.0%	0		10.89s	579	0

استدعاء الأدوات	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
DeepSeek V3.2	10.0	10.0	100.0%	0		11.85s	522	0
Qwen3.5-Flash	10.0	10.0	100.0%	0		3.67s	264	0

معلومات عامة	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
DeepSeek V3.2	3.0	10.0	0.0%	0		17.23s	17	0
Qwen3.5-Flash	3.0	10.0	0.0%	0		588ms	9	0

مقارنة سريعة

تبديل زوج المقارنة

gpt-oss-120bmediumمتاح مجانًاvsQwen3.5-Flashnone Nemotron 3 Supermediumمتاح مجانًاvsQwen3.5-Flashnone Owl AlphamediumvsQwen3.5-Flashnone DeepSeek V3.2nonevsMiniMax M2.5medium DeepSeek V3.2nonevsMistral Small 4medium CobuddymediumvsQwen3.5-Flashnone GPT-5 NanomediumvsQwen3.5-Flashnone CobuddymediumvsDeepSeek V3.2none DeepSeek V3.2nonevsElephant Alphamedium DeepSeek V3.2nonevsMiniMax M2.7medium DeepSeek V3.2nonevsOwl Alphamedium DeepSeek V3.2nonevsgpt-oss-120bmediumمتاح مجانًا