निर्देश पालन: अतिरिक्त फॉर्मेटिंग
निर्देश पालन
अतिरिक्त फॉर्मेटिंग
देखें कि निर्देश पालन में किन AI मॉडलों में अतिरिक्त फॉर्मेटिंग आने की सबसे अधिक संभावना है, ताकि आप कमजोरियाँ जल्दी पहचान सकें। क्रमबद्ध करें: सही परीक्षण ↑.
विफलता के कारण
7/7
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | अतिरिक्त फॉर्मेटिंग संख्या | श्रेणी स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #291 | Granite 4.2 8B none | IBM Granite | 1 | 3.0 | $0.026 | 0/2 | 79.5s |
| #114 | DeepSeek V4 Flash 0731 medium | DeepSeek | 1 | 8.5 | $0.066 | 1/2 | 2.42s |
| #136 | Claude Fable 5.1 low | Anthropic | 1 | 6.5 | $2.565 | 1/2 | 5.24s |
| #181 | Claude Sonnet 5 none | Anthropic | 1 | 6.4 | $0.548 | 1/2 | 2.58s |
| #233 | DeepSeek V4 Flash 0423 none | DeepSeek | 1 | 6.5 | $0.037 | 1/2 | 17.5s |
| #243 | Seed-2.0-Code none | Bytedance Seed | 1 | 6.2 | $0.151 | 1/2 | 1.80s |
| #295 | Hy3 preview none | Tencent | 1 | 6.3 | $0.007 | 1/2 | 13.0s |