ترتيب إخفاقات لا توجد إجابة

اكتشف أي نماذج الذكاء الاصطناعي تواجه لا توجد إجابة أكثر من غيرها، حتى ترى مخاطر الاعتمادية قبل الاختيار. الترتيب حسب: زمن الاستجابة (المتوسط) ↑.

النماذج المعروضة

إجمالي الإخفاقات

النموذج الأكثر تأثرًا

Gemini 3.1 Flash Lite Preview 1

الفئات

ضمن الفئة مجمّع29 ضمن الفئة البرمجة18 ضمن الفئة معلومات عامة13 ضمن الفئة تحليل البيانات واستخراجها8 ضمن الفئة خاص بالمجال8 ضمن الفئة حيل مضادة للذكاء الاصطناعي4 ضمن الفئة حل الألغاز3 ضمن الفئة اتباع التعليمات2 ضمن الفئة استدعاء الأدوات2

67/67

الترتيب	النموذج	الشركة	عدد لا توجد إجابة	النتيجة	إجمالي التكلفة	اختبارات صحيحة	زمن الاستجابة (المتوسط)
#106	Gemini 3.1 Flash Lite Preview none	Google	1	6.4	$0.052	12/22	1.58s
إجمالي الاختبارات 22 الاختبارات الخاطئة 10 إجمالي التكلفة $0.052 زمن الاستجابة (المتوسط) 1.58s
#132	GPT-5.6 Terra none	OpenAI	1	6.0	$0.349	8/22	1.65s
إجمالي الاختبارات 22 الاختبارات الخاطئة 14 إجمالي التكلفة $0.349 زمن الاستجابة (المتوسط) 1.65s
#122	Gemini 3.1 Flash Lite none	Google	1	6.1	$0.046	9/22	1.75s
إجمالي الاختبارات 22 الاختبارات الخاطئة 13 إجمالي التكلفة $0.046 زمن الاستجابة (المتوسط) 1.75s
#120	Gemini 3.1 Flash Lite minimal	Google	1	6.1	$0.047	10/22	1.86s
إجمالي الاختبارات 22 الاختبارات الخاطئة 12 إجمالي التكلفة $0.047 زمن الاستجابة (المتوسط) 1.86s
#174	GPT-4o-mini none	OpenAI	1	5.0	$0.010	5/22	1.99s
إجمالي الاختبارات 22 الاختبارات الخاطئة 17 إجمالي التكلفة $0.010 زمن الاستجابة (المتوسط) 1.99s
#180	GPT-5.4 Nano none	OpenAI	1	4.8	$0.041	4/22	2.57s
إجمالي الاختبارات 22 الاختبارات الخاطئة 18 إجمالي التكلفة $0.041 زمن الاستجابة (المتوسط) 2.57s
#89	Gemini 3 Flash Preview none	Google	1	6.8	$0.085	13/22	2.95s
إجمالي الاختبارات 22 الاختبارات الخاطئة 9 إجمالي التكلفة $0.085 زمن الاستجابة (المتوسط) 2.95s
#154	MiMo-V2.5-Pro none	Xiaomi	1	5.5	$0.068	6/22	4.12s
إجمالي الاختبارات 22 الاختبارات الخاطئة 16 إجمالي التكلفة $0.068 زمن الاستجابة (المتوسط) 4.12s
#116	Seed-2.0-Lite none	Bytedance Seed	1	6.2	$0.066	8/22	4.40s
إجمالي الاختبارات 22 الاختبارات الخاطئة 14 إجمالي التكلفة $0.066 زمن الاستجابة (المتوسط) 4.40s
#168	MiMo-V2.5 none	Xiaomi	1	5.1	$0.025	5/22	4.62s
إجمالي الاختبارات 22 الاختبارات الخاطئة 17 إجمالي التكلفة $0.025 زمن الاستجابة (المتوسط) 4.62s
#66	Claude Opus 4.8 none	Anthropic	1	7.3	$1.166	13/22	4.91s
إجمالي الاختبارات 22 الاختبارات الخاطئة 9 إجمالي التكلفة $1.166 زمن الاستجابة (المتوسط) 4.91s
#161	Qwen3.6 35B A3B none	Qwen	1	5.3	$0.061	4/22	5.52s
إجمالي الاختبارات 22 الاختبارات الخاطئة 18 إجمالي التكلفة $0.061 زمن الاستجابة (المتوسط) 5.52s
#112	Claude Sonnet 5 none	Anthropic	2	6.3	$0.548	8/22	6.04s
إجمالي الاختبارات 22 الاختبارات الخاطئة 14 إجمالي التكلفة $0.548 زمن الاستجابة (المتوسط) 6.04s
#151	GLM 5.1 none	Z.ai	1	5.5	$0.164	7/22	6.70s
إجمالي الاختبارات 22 الاختبارات الخاطئة 15 إجمالي التكلفة $0.164 زمن الاستجابة (المتوسط) 6.70s
#198	Laguna Xs.2 medium	Poolside	2	4.1	$0.015	6/19	6.73s
إجمالي الاختبارات 19 الاختبارات الخاطئة 13 إجمالي التكلفة $0.015 زمن الاستجابة (المتوسط) 6.73s

1 2 3 4 5

→

إخفاقات لا توجد إجابة

تصفية النماذج

أفضل النماذج حسب عدد لا توجد إجابة

عدد لا توجد إجابة مقابل النتيجة

أفضل النماذج حسب زمن الاستجابة (المتوسط)