اضافی فارمیٹنگ ناکامیاں
دیکھیں کہ کن AI ماڈلز میں اضافی فارمیٹنگ سب سے زیادہ ہوتا ہے، تاکہ آپ انتخاب سے پہلے قابلِ اعتماد ہونے کے خطرات سمجھ سکیں۔ ترتیب دیں حسب: درست ٹیسٹس ↓.
68/68
ماڈلز فلٹر کریں
موجودہ تلاش اور فلٹرز سے کوئی ماڈل مطابقت نہیں رکھتا۔
| درجہ | ماڈل | کمپنی | اضافی فارمیٹنگ کی تعداد | اسکور | کل لاگت | درست ٹیسٹس | ردِعمل کا وقت (اوسط) |
|---|---|---|---|---|---|---|---|
| #20 | Claude Opus 5 high | Anthropic | 1 | 9.2 | $3.070 | 18/22 | 22.5s |
| #43 | GLM 5.3 Flash max | Z.ai | 1 | 8.7 | $0.071 | 16/22 | 52.1s |
| #79 | Kimi K3 max | Moonshot AI | 1 | 7.9 | $2.528 | 16/22 | 142.8s |
| #91 | Claude Opus 4.8 low | Anthropic | 1 | 7.8 | $2.089 | 16/22 | 12.9s |
| #65 | Claude Fable 5.1 medium | Anthropic | 1 | 8.3 | $2.909 | 15/22 | 11.7s |
| #46 | Muse Spark 1.2 medium | Meta | 1 | 8.6 | $1.339 | 14/22 | 19.7s |
| #88 | Claude Sonnet 4.6 medium | Anthropic | 3 | 7.8 | $2.126 | 14/22 | 28.1s |
| #95 | Claude Opus 4.6 medium | Anthropic | 4 | 7.7 | $2.961 | 13/22 | 32.2s |
| #108 | Qwen3.5-27B medium | Qwen | 1 | 7.5 | $0.982 | 13/22 | 113.3s |
| #111 | Grok Build 0.1 medium | X AI | 3 | 7.5 | $1.130 | 13/22 | 54.5s |
| #122 | GLM 5.3 high | Z.ai | 2 | 7.3 | $0.403 | 13/22 | 27.8s |
| #124 | GLM 5.3 Flash high | Z.ai | 2 | 7.3 | $0.034 | 13/22 | 25.4s |
| #128 | Claude Opus 4.8 none | Anthropic | 3 | 7.3 | $1.166 | 13/22 | 4.92s |
| #191 | Mimo V2 PRO medium | Xiaomi | 1 | 6.3 | $0.333 | 12/21 | 22.2s |
| #192 | MiMo-V2-Flash medium | Xiaomi | 1 | 6.3 | $0.043 | 12/21 | 20.1s |