AI BENCHY Compare

OpenAI: GPT-4o-mini vs Laguna M.1

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-04-29

المقياس	GPT-4o-mini GPT-4o-mini none الإصدار: 2024-07-18	Laguna M.1 Laguna M.1 medium الإصدار: 2026-04-28 متاح مجانًا

المقياس	GPT-4o-mini GPT-4o-mini none الإصدار: 2024-07-18	Laguna M.1 Laguna M.1 medium الإصدار: 2026-04-28 متاح مجانًا
النتيجة	4.9	6.3
الترتيب	#119	#74
الموثوقية	غير متاح	10.0
الاتساق	9.9	8.6
اختبارات صحيحة
معدل النجاح لكل محاولة	22.2%	53.7%
اختبارات غير مستقرة	0	3
إجمالي مرات التشغيل	54	54
التكلفة لكل نتيجة	0.122	0.000
إجمالي التكلفة	$0.005	$0.000
??? ???????	$0.150 / 1M	$0.000 / 1M
??? ???????	$0.600 / 1M	$0.000 / 1M
رموز الإخراج	1,947	63,822
رموز الاستدلال	0	0
زمن الاستجابة (المتوسط)	2.00s	13.90s
زمن الاستجابة (الحد الأقصى)	7.58s	53.14s
زمن الاستجابة (الإجمالي)	21.99s	250.28s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
GPT-4o-mini	4.8	10.0	25.0%	0		1.34s	186	0
Laguna M.1	6.6	10.0	50.0%	0		9.15s	7,839	0

البرمجة	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
GPT-4o-mini	3.0	8.7	0.0%	0		2.55s	347	0
Laguna M.1	4.3	1.1	66.7%	1		35.61s	14,327	0

مجمّع	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
GPT-4o-mini	3.0	10.0	0.0%	0		7.58s	568	0
Laguna M.1	3.0	10.0	0.0%	0		53.14s	12,272	0

تحليل البيانات واستخراجها	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
GPT-4o-mini	10.0	10.0	100.0%	0		1.27s	183	0
Laguna M.1	10.0	10.0	100.0%	0		4.93s	2,296	0

خاص بالمجال	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
GPT-4o-mini	3.0	10.0	0.0%	0		637ms	15	0
Laguna M.1	5.3	7.2	44.4%	1		24.14s	19,020	0

الذكاء العام	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
GPT-4o-mini	4.0	10.0	0.0%	0		909ms	66	0
Laguna M.1	4.1	10.0	0.0%	0		6.86s	1,294	0

اتباع التعليمات	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
GPT-4o-mini	4.8	10.0	0.0%	0		1.27s	69	0
Laguna M.1	10.0	10.0	100.0%	0		4.30s	1,626	0

حل الألغاز	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
GPT-4o-mini	3.7	10.0	0.0%	0		1.30s	308	0
Laguna M.1	3.6	7.2	22.2%	1		6.97s	3,978	0

استدعاء الأدوات	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
GPT-4o-mini	10.0	10.0	100.0%	0		2.51s	205	0
Laguna M.1	10.0	10.0	100.0%	0		6.31s	1,170	0

مقارنة سريعة

تبديل زوج المقارنة

Laguna M.1mediumمتاح مجانًاvsMiMo-V2-Omninone Laguna M.1mediumمتاح مجانًاvsGLM 5V Turbonone Laguna M.1mediumمتاح مجانًاvsQwen3.5-Flashnone GPT-4o-mininonevsQwen3 Coder Nextmedium Gemma 4 26B A4Bnoneمتاح مجانًاvsLaguna M.1mediumمتاح مجانًا Seed-2.0-LitenonevsLaguna M.1mediumمتاح مجانًا Gemini 2.5 FlashnonevsLaguna M.1mediumمتاح مجانًا Laguna M.1mediumمتاح مجانًاvsQwen3.5-35B-A3Bnone GPT-4o-mininonevsGLM 4.7 Flashmedium Laguna M.1mediumمتاح مجانًاvsQwen3.6 27Bnone Laguna M.1mediumمتاح مجانًاvsGLM 5none DeepSeek V4 PrononevsLaguna M.1mediumمتاح مجانًا