اضافی فارمیٹنگ ناکامیاں
دیکھیں کہ کن AI ماڈلز میں اضافی فارمیٹنگ سب سے زیادہ ہوتا ہے، تاکہ آپ انتخاب سے پہلے قابلِ اعتماد ہونے کے خطرات سمجھ سکیں۔ ترتیب دیں حسب: ناکامیوں کی تعداد ↑.
68/68
ماڈلز فلٹر کریں
موجودہ تلاش اور فلٹرز سے کوئی ماڈل مطابقت نہیں رکھتا۔
| درجہ | ماڈل | کمپنی | اضافی فارمیٹنگ کی تعداد | اسکور | کل لاگت | درست ٹیسٹس | ردِعمل کا وقت (اوسط) |
|---|---|---|---|---|---|---|---|
| #102 | Claude Opus 5 none | Anthropic | 2 | 7.5 | $1.550 | 12/22 | 7.65s |
| #122 | GLM 5.3 high | Z.ai | 2 | 7.3 | $0.403 | 13/22 | 27.8s |
| #124 | GLM 5.3 Flash high | Z.ai | 2 | 7.3 | $0.034 | 13/22 | 25.4s |
| #146 | Grok 4.20 medium | X AI | 2 | 7.0 | $0.805 | 11/22 | 32.6s |
| #188 | MiMo-V2.5 medium | Xiaomi | 2 | 6.4 | $0.104 | 11/22 | 46.3s |
| #226 | North Mini Code medium | Cohere | 2 | 5.7 | $0.000 | 8/22 | 142.0s |
| #248 | DeepSeek V4 Flash 0423 none | DeepSeek | 2 | 5.4 | $0.040 | 4/22 | 36.2s |
| #259 | Seed-2.0-Code none | Bytedance Seed | 2 | 5.3 | $0.151 | 6/22 | 14.7s |
| #275 | North Mini Code none | Cohere | 2 | 5.1 | $0.000 | 4/22 | 29.9s |
| #279 | DeepSeek V3.2 none | DeepSeek | 2 | 5.0 | $0.054 | 6/22 | 17.9s |
| #290 | Grok 4.20 Multi Agent Beta medium | X AI | 2 | 4.8 | $5.599 | 8/18 | 9.69s |
| #88 | Claude Sonnet 4.6 medium | Anthropic | 3 | 7.8 | $2.126 | 14/22 | 28.1s |
| #111 | Grok Build 0.1 medium | X AI | 3 | 7.5 | $1.130 | 13/22 | 54.5s |
| #128 | Claude Opus 4.8 none | Anthropic | 3 | 7.3 | $1.166 | 13/22 | 4.92s |
| #161 | MiMo-V2.5-Pro medium | Xiaomi | 3 | 6.8 | $0.221 | 11/22 | 48.7s |