AI BENCHY زمرہ ناکامیاں
پہیلی حل کرنا: اضافی فارمیٹنگ
پہیلی حل کرنا
اضافی فارمیٹنگ
دیکھیں کہ پہیلی حل کرنا میں کن AI ماڈلز کو اضافی فارمیٹنگ پیش آنے کا سب سے زیادہ امکان ہے، تاکہ آپ کمزوریاں جلدی پہچان سکیں۔
ناکامی کی وجوہات
| درجہ | ماڈل | کمپنی | اضافی فارمیٹنگ کی تعداد | زمرہ اسکور | درست ٹیسٹس | ردِعمل کا وقت (اوسط) |
|---|---|---|---|---|---|---|
| #23 | MiMo-V2-Pro medium | Xiaomi | 1 | 7.0 | 1/3 | 4.71s |
| #42 | Claude Sonnet 4.6 none | Anthropic | 1 | 7.7 | 2/3 | 2.92s |