إخفاقات تنسيق إضافي
اكتشف أي نماذج الذكاء الاصطناعي تواجه تنسيق إضافي أكثر من غيرها، حتى ترى مخاطر الاعتمادية قبل الاختيار.
42/42
تصفية النماذج
لا توجد نماذج تطابق البحث والفلاتر الحالية.
| الترتيب | النموذج | الشركة | عدد تنسيق إضافي | النتيجة | إجمالي التكلفة | اختبارات صحيحة | زمن الاستجابة (المتوسط) |
|---|---|---|---|---|---|---|---|
| #149 | KAT-Coder-Air V2.5 medium | Kwaipilot | 1 | 5.6 | $0.048 | 8/22 | 8.42s |
| #157 | Mimo V2 Omni none | Xiaomi | 1 | 5.5 | $0.021 | 8/21 | 2.44s |
| #159 | GPT-5.6 Luna none | OpenAI | 1 | 5.4 | $0.142 | 6/22 | 1.50s |
| #164 | Inkling none | Thinkingmachines | 1 | 5.2 | $0.147 | 6/22 | 3.50s |
| #166 | Qwen3 Coder Next none | Qwen | 1 | 5.1 | $0.025 | 5/22 | 9.12s |
| #168 | MiMo-V2.5 none | Xiaomi | 1 | 5.1 | $0.025 | 5/22 | 4.62s |
| #184 | Hunter Alpha medium | OpenRouter | 1 | 4.7 | $0.000 | 8/18 | 10.3s |
| #197 | Grok 4.20 none | X AI | 1 | 4.1 | $0.057 | 6/18 | 1.11s |
| #199 | Hy3 preview none | Tencent | 1 | 4.0 | $0.003 | 4/21 | 12.9s |
| #200 | MiMo-V2-Flash none | Xiaomi | 1 | 4.0 | $0.025 | 4/21 | 2.76s |
| #201 | Granite 4.1 8B none | IBM Granite | 1 | 4.0 | $0.007 | 2/22 | 1.45s |
| #204 | Qwen3.5-9B medium | Qwen | 1 | 3.8 | $0.036 | 3/22 | 82.2s |