اضافی فارمیٹنگ ناکامیاں
دیکھیں کہ کن AI ماڈلز میں اضافی فارمیٹنگ سب سے زیادہ ہوتا ہے، تاکہ آپ انتخاب سے پہلے قابلِ اعتماد ہونے کے خطرات سمجھ سکیں۔ ترتیب دیں حسب: درست ٹیسٹس ↓.
68/68
ماڈلز فلٹر کریں
موجودہ تلاش اور فلٹرز سے کوئی ماڈل مطابقت نہیں رکھتا۔
| درجہ | ماڈل | کمپنی | اضافی فارمیٹنگ کی تعداد | اسکور | کل لاگت | درست ٹیسٹس | ردِعمل کا وقت (اوسط) |
|---|---|---|---|---|---|---|---|
| #73 | Muse Spark 1.1 high | Meta | 1 | 8.0 | $2.253 | 12/22 | 36.9s |
| #100 | Solar Pro 4 xhigh | Upstage | 1 | 7.6 | $0.150 | 12/22 | 134.9s |
| #102 | Claude Opus 5 none | Anthropic | 2 | 7.5 | $1.550 | 12/22 | 7.65s |
| #121 | Claude Sonnet 4.6 none | Anthropic | 4 | 7.3 | $0.661 | 12/22 | 7.67s |
| #140 | Grok 4.3 medium | X AI | 1 | 7.0 | $0.741 | 12/22 | 44.2s |
| #143 | GLM 5.1 medium | Z.ai | 1 | 7.0 | $0.727 | 12/22 | 58.8s |
| #158 | Solar Pro 4 medium | Upstage | 1 | 6.8 | $0.140 | 12/22 | 127.6s |
| #105 | MiniMax M3 medium | Minimax | 1 | 7.5 | $0.300 | 11/22 | 75.2s |
| #127 | DeepSeek V4 Flash 0731 medium | DeepSeek | 1 | 7.3 | $0.046 | 11/22 | 84.7s |
| #138 | Solar Pro 4 high | Upstage | 1 | 7.1 | $0.138 | 11/22 | 120.6s |
| #146 | Grok 4.20 medium | X AI | 2 | 7.0 | $0.805 | 11/22 | 32.6s |
| #150 | Claude Fable 5.1 low | Anthropic | 4 | 6.9 | $2.565 | 11/22 | 10.3s |
| #161 | MiMo-V2.5-Pro medium | Xiaomi | 3 | 6.8 | $0.221 | 11/22 | 48.7s |
| #188 | MiMo-V2.5 medium | Xiaomi | 2 | 6.4 | $0.104 | 11/22 | 46.3s |
| #219 | Mimo V2 Omni medium | Xiaomi | 1 | 5.9 | $0.683 | 10/21 | 41.2s |