اضافی فارمیٹنگ ناکامیاں
دیکھیں کہ کن AI ماڈلز میں اضافی فارمیٹنگ سب سے زیادہ ہوتا ہے، تاکہ آپ انتخاب سے پہلے قابلِ اعتماد ہونے کے خطرات سمجھ سکیں۔ ترتیب دیں حسب: کل لاگت ↓.
68/68
ماڈلز فلٹر کریں
موجودہ تلاش اور فلٹرز سے کوئی ماڈل مطابقت نہیں رکھتا۔
| درجہ | ماڈل | کمپنی | اضافی فارمیٹنگ کی تعداد | اسکور | کل لاگت | درست ٹیسٹس | ردِعمل کا وقت (اوسط) |
|---|---|---|---|---|---|---|---|
| #290 | Grok 4.20 Multi Agent Beta medium | X AI | 2 | 4.8 | $5.599 | 8/18 | 9.69s |
| #20 | Claude Opus 5 high | Anthropic | 1 | 9.2 | $3.070 | 18/22 | 22.5s |
| #95 | Claude Opus 4.6 medium | Anthropic | 4 | 7.7 | $2.961 | 13/22 | 32.2s |
| #65 | Claude Fable 5.1 medium | Anthropic | 1 | 8.3 | $2.909 | 15/22 | 11.7s |
| #150 | Claude Fable 5.1 low | Anthropic | 4 | 6.9 | $2.565 | 11/22 | 10.3s |
| #79 | Kimi K3 max | Moonshot AI | 1 | 7.9 | $2.528 | 16/22 | 142.8s |
| #73 | Muse Spark 1.1 high | Meta | 1 | 8.0 | $2.253 | 12/22 | 36.9s |
| #88 | Claude Sonnet 4.6 medium | Anthropic | 3 | 7.8 | $2.126 | 14/22 | 28.1s |
| #91 | Claude Opus 4.8 low | Anthropic | 1 | 7.8 | $2.089 | 16/22 | 12.9s |
| #102 | Claude Opus 5 none | Anthropic | 2 | 7.5 | $1.550 | 12/22 | 7.65s |
| #46 | Muse Spark 1.2 medium | Meta | 1 | 8.6 | $1.339 | 14/22 | 19.7s |
| #128 | Claude Opus 4.8 none | Anthropic | 3 | 7.3 | $1.166 | 13/22 | 4.92s |
| #156 | Seed-2.0-Code medium | Bytedance Seed | 1 | 6.8 | $1.153 | 10/22 | 101.1s |
| #111 | Grok Build 0.1 medium | X AI | 3 | 7.5 | $1.130 | 13/22 | 54.5s |
| #108 | Qwen3.5-27B medium | Qwen | 1 | 7.5 | $0.982 | 13/22 | 113.3s |