API خرابی ناکامیاں
دیکھیں کہ کن AI ماڈلز میں API خرابی سب سے زیادہ ہوتا ہے، تاکہ آپ انتخاب سے پہلے قابلِ اعتماد ہونے کے خطرات سمجھ سکیں۔
94/94
ماڈلز فلٹر کریں
موجودہ تلاش اور فلٹرز سے کوئی ماڈل مطابقت نہیں رکھتا۔
| درجہ | ماڈل | کمپنی | API خرابی کی تعداد | اسکور | کل لاگت | درست ٹیسٹس | ردِعمل کا وقت (اوسط) |
|---|---|---|---|---|---|---|---|
| #128 | DeepSeek V3.2 medium | DeepSeek | 2 | 7.0 | $0.078 | 11/22 | 68.4s |
| #152 | LongCat 2.0 low | Meituan | 2 | 6.7 | $0.412 | 10/22 | 113.6s |
| #162 | Qwen3.6 35B A3B medium | Qwen | 2 | 6.6 | $0.672 | 12/22 | 58.5s |
| #175 | Ring-2.6-1T medium | Inclusionai | 2 | 6.4 | $0.102 | 11/22 | 68.8s |
| #179 | Gemma 4 31B medium | 2 | 6.2 | $0.100 | 13/22 | 78.6s | |
| #191 | Gemma 4 31B none | 2 | 6.1 | $0.016 | 9/22 | 5.41s | |
| #193 | Nemotron 3 Ultra none | NVIDIA | 2 | 6.1 | $0.084 | 8/22 | 3.88s |
| #194 | Trinity Large Thinking low | Arcee AI | 2 | 6.0 | $0.625 | 8/22 | 96.6s |
| #235 | KAT-Coder-Air V2.5 low | Kwaipilot | 2 | 5.4 | $0.046 | 7/22 | 10.6s |
| #246 | Qwen3.6 35B A3B none | Qwen | 2 | 5.3 | $0.051 | 4/22 | 5.57s |
| #266 | Ling-2.6-flash none | Inclusionai | 2 | 4.9 | $0.002 | 6/22 | 10.7s |
| #273 | Grok 4.20 Multi Agent Beta medium | X AI | 2 | 4.8 | $5.599 | 8/18 | 9.69s |
| #276 | Trinity Large Preview none | Arcee AI | 2 | 4.8 | $0.008 | 4/21 | 2.98s |
| #54 | Muse Spark 1.3 low | Meta | 1 | 8.2 | $0.689 | 15/22 | 16.0s |
| #60 | Muse Spark 1.1 high | Meta | 1 | 8.0 | $2.253 | 12/22 | 36.9s |