اضافی فارمیٹنگ ناکامیاں
دیکھیں کہ کن AI ماڈلز میں اضافی فارمیٹنگ سب سے زیادہ ہوتا ہے، تاکہ آپ انتخاب سے پہلے قابلِ اعتماد ہونے کے خطرات سمجھ سکیں۔ ترتیب دیں حسب: ردِعمل کا وقت (اوسط) ↓.
68/68
ماڈلز فلٹر کریں
موجودہ تلاش اور فلٹرز سے کوئی ماڈل مطابقت نہیں رکھتا۔
| درجہ | ماڈل | کمپنی | اضافی فارمیٹنگ کی تعداد | اسکور | کل لاگت | درست ٹیسٹس | ردِعمل کا وقت (اوسط) |
|---|---|---|---|---|---|---|---|
| #122 | GLM 5.3 high | Z.ai | 2 | 7.3 | $0.403 | 13/22 | 27.8s |
| #124 | GLM 5.3 Flash high | Z.ai | 2 | 7.3 | $0.034 | 13/22 | 25.4s |
| #20 | Claude Opus 5 high | Anthropic | 1 | 9.2 | $3.070 | 18/22 | 22.5s |
| #191 | Mimo V2 PRO medium | Xiaomi | 1 | 6.3 | $0.333 | 12/21 | 22.2s |
| #255 | DeepSeek V4 Flash 0731 none | DeepSeek | 1 | 5.4 | $0.009 | 4/22 | 20.7s |
| #192 | MiMo-V2-Flash medium | Xiaomi | 1 | 6.3 | $0.043 | 12/21 | 20.1s |
| #46 | Muse Spark 1.2 medium | Meta | 1 | 8.6 | $1.339 | 14/22 | 19.7s |
| #279 | DeepSeek V3.2 none | DeepSeek | 2 | 5.0 | $0.054 | 6/22 | 17.9s |
| #235 | KAT-Coder-Air V2.5 high | Kwaipilot | 3 | 5.6 | $0.077 | 7/22 | 15.9s |
| #259 | Seed-2.0-Code none | Bytedance Seed | 2 | 5.3 | $0.151 | 6/22 | 14.7s |
| #314 | Ling 3.0 Tiny none | Inclusionai | 1 | 4.0 | $0.000 | 2/22 | 14.0s |
| #312 | Hy3 preview none | Tencent | 1 | 4.0 | $0.007 | 4/21 | 12.9s |
| #91 | Claude Opus 4.8 low | Anthropic | 1 | 7.8 | $2.089 | 16/22 | 12.9s |
| #291 | KAT-Coder-Air V2.5 none | Kwaipilot | 3 | 4.8 | $0.070 | 5/22 | 12.5s |
| #159 | DeepSeek V4 Pro none | DeepSeek | 1 | 6.8 | $0.351 | 9/22 | 11.7s |