اضافی فارمیٹنگ ناکامیاں
دیکھیں کہ کن AI ماڈلز میں اضافی فارمیٹنگ سب سے زیادہ ہوتا ہے، تاکہ آپ انتخاب سے پہلے قابلِ اعتماد ہونے کے خطرات سمجھ سکیں۔ ترتیب دیں حسب: درست ٹیسٹس ↓.
42/42
ماڈلز فلٹر کریں
موجودہ تلاش اور فلٹرز سے کوئی ماڈل مطابقت نہیں رکھتا۔
| درجہ | ماڈل | کمپنی | اضافی فارمیٹنگ کی تعداد | اسکور | کل لاگت | درست ٹیسٹس | ردِعمل کا وقت (اوسط) |
|---|---|---|---|---|---|---|---|
| #159 | GPT-5.6 Luna none | OpenAI | 1 | 5.4 | $0.142 | 6/22 | 1.50s |
| #164 | Inkling none | Thinkingmachines | 1 | 5.2 | $0.147 | 6/22 | 3.50s |
| #173 | DeepSeek V3.2 none | DeepSeek | 2 | 5.0 | $0.054 | 6/22 | 18.3s |
| #150 | DeepSeek V4 Flash none | DeepSeek | 2 | 5.6 | $0.044 | 5/22 | 36.8s |
| #166 | Qwen3 Coder Next none | Qwen | 1 | 5.1 | $0.025 | 5/22 | 9.12s |
| #168 | MiMo-V2.5 none | Xiaomi | 1 | 5.1 | $0.025 | 5/22 | 4.62s |
| #182 | KAT-Coder-Air V2.5 none | Kwaipilot | 3 | 4.8 | $0.067 | 5/22 | 12.2s |
| #199 | Hy3 preview none | Tencent | 1 | 4.0 | $0.003 | 4/21 | 12.9s |
| #200 | MiMo-V2-Flash none | Xiaomi | 1 | 4.0 | $0.025 | 4/21 | 2.76s |
| #171 | North Mini Code none | Cohere | 2 | 5.1 | $0.000 | 4/22 | 29.9s |
| #204 | Qwen3.5-9B medium | Qwen | 1 | 3.8 | $0.036 | 3/22 | 82.2s |
| #201 | Granite 4.1 8B none | IBM Granite | 1 | 4.0 | $0.007 | 2/22 | 1.45s |