AI BENCHY Compare

OpenAI: GPT-5.5 vs Laguna Xs.2

الملخص

مقارنة benchmark بين GPT-5.5 و Laguna Xs.2: يتقدم GPT-5.5 في متوسط النتيجة بـ 9.3 مقابل 5.5. لدى Laguna Xs.2 تكلفة benchmark أقل عند $0.000 مقابل $0.907. Laguna Xs.2 أسرع عند 6.73s مقابل 9.76s، مع معدلات نجاح 85.7% مقابل 50.9%.

النموذج الموصى به: GPT-5.5 - It has the strongest score in this comparison (9.3) and the best overall balance of cost and response time across all 2 models.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-06-12

المقياس	GPT-5.5 GPT-5.5 low الإصدار: 2026-04-24	Laguna Xs.2 Laguna Xs.2 medium الإصدار: 2026-04-28 متاح مجانًا

المقياس	GPT-5.5 GPT-5.5 low الإصدار: 2026-04-24	Laguna Xs.2 Laguna Xs.2 medium الإصدار: 2026-04-28 متاح مجانًا
النتيجة	9.3	5.5
الترتيب	#5	#123
الموثوقية	10.0	10.0
الاتساق	10.0	7.4
اختبارات صحيحة
معدل النجاح لكل محاولة	85.7%	50.9%
اختبارات غير مستقرة	0	6
إجمالي مرات التشغيل	63	57
التكلفة لكل نتيجة	5.035	0.000
إجمالي التكلفة	$0.907	$0.000
سعر الإدخال	$5.000 / 1M	$0.000 / 1M
سعر الإخراج	$30.000 / 1M	$0.000 / 1M
إجمالي رموز الإدخال	34,209	39,481
رموز الإخراج	2,046	54,218
رموز الاستدلال	22,460	0
زمن الاستجابة (المتوسط)	9.76s	6.73s
زمن الاستجابة (الحد الأقصى)	56.19s	29.11s
زمن الاستجابة (الإجمالي)	204.92s	100.98s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#5 GPT-5.5

low

Cost: $0.068
Time: 37.0s
Tokens: 2,339 tok

#123 Laguna Xs.2

medium

No showcase result has been generated for this model yet.

Cost: $0.000
Time: -
Tokens: 0 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
GPT-5.5	10.0	10.0	100.0%	0		4.41s	606	238	1,020
Laguna Xs.2	6.9	7.9	66.7%	1		2.68s	579	4,062	0

البرمجة	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
GPT-5.5	10.0	10.0	100.0%	0		15.04s	7,302	423	6,402
Laguna Xs.2	6.3	3.7	33.3%	1		14.36s	816	7,896	0

مجمّع	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
GPT-5.5	10.0	10.0	100.0%	0		9.56s	11,019	303	717
Laguna Xs.2	3.0	10.0	0.0%	0		15.92s	18,436	8,501	0

تحليل البيانات واستخراجها	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
GPT-5.5	10.0	10.0	100.0%	0		3.28s	7,140	228	157
Laguna Xs.2	7.1	5.6	83.3%	1		9.34s	7,734	10,472	0

خاص بالمجال	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
GPT-5.5	5.3	10.0	33.3%	0		28.05s	723	69	11,609
Laguna Xs.2	4.1	4.4	44.5%	2		11.12s	834	18,712	0

الذكاء العام	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
GPT-5.5	10.0	10.0	100.0%	0		5.17s	477	133	245
Laguna Xs.2	3.0	10.0	0.0%	0		0ms	0	0	0

اتباع التعليمات	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
GPT-5.5	9.9	10.0	100.0%	0		3.74s	660	93	415
Laguna Xs.2	10.0	10.0	100.0%	0		1.68s	753	1,517	0

حل الألغاز	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
GPT-5.5	10.0	10.0	100.0%	0		4.74s	642	279	954
Laguna Xs.2	5.3	10.0	33.3%	0		1.93s	453	1,887	0

استدعاء الأدوات	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
GPT-5.5	10.0	10.0	100.0%	0		4.96s	5,445	250	101
Laguna Xs.2	4.7	1.6	66.7%	1		3.39s	9,876	1,171	0

معلومات عامة	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
GPT-5.5	3.0	10.0	0.0%	0		10.06s	195	30	840
Laguna Xs.2	3.0	10.0	0.0%	0		0ms	0	0	0

مقارنة سريعة

تبديل زوج المقارنة

GPT-5.5lowvsQwen3.7 Maxmedium Claude Fable 5mediumvsGPT-5.5low Gemini 3.1 Pro PreviewmediumvsGPT-5.5low Gemini 3.5 FlashmediumvsGPT-5.5low Gemini 3 Flash PreviewmediumvsGPT-5.5low GPT-5.5lowvsQwen3.6 Max Previewmedium Claude Opus 4.8mediumvsGPT-5.5low Gemini 3.5 FlashhighvsGPT-5.5low Claude Opus 4.7mediumvsGPT-5.5low GPT-5.5lowvsGLM 5medium Seed-2.0-LitemediumvsGPT-5.5low GPT-5.5lowvsStep 3.7 Flashmedium