API خرابی ناکامیاں
دیکھیں کہ کن AI ماڈلز میں API خرابی سب سے زیادہ ہوتا ہے، تاکہ آپ انتخاب سے پہلے قابلِ اعتماد ہونے کے خطرات سمجھ سکیں۔ ترتیب دیں حسب: کل لاگت ↓.
94/94
ماڈلز فلٹر کریں
موجودہ تلاش اور فلٹرز سے کوئی ماڈل مطابقت نہیں رکھتا۔
| درجہ | ماڈل | کمپنی | API خرابی کی تعداد | اسکور | کل لاگت | درست ٹیسٹس | ردِعمل کا وقت (اوسط) |
|---|---|---|---|---|---|---|---|
| #273 | Grok 4.20 Multi Agent Beta medium | X AI | 2 | 4.8 | $5.599 | 8/18 | 9.69s |
| #66 | Kimi K3 max | Moonshot AI | 2 | 7.9 | $3.467 | 16/22 | 142.8s |
| #60 | Muse Spark 1.1 high | Meta | 1 | 8.0 | $2.253 | 12/22 | 36.9s |
| #228 | Hy4 preview low | Tencent | 14 | 5.6 | $1.745 | 3/22 | 214.3s |
| #138 | Seed-2.0-Code high | Bytedance Seed | 5 | 6.9 | $1.273 | 11/22 | 124.2s |
| #142 | Seed-2.0-Code medium | Bytedance Seed | 6 | 6.8 | $1.153 | 10/22 | 101.1s |
| #183 | Qwen3.5-35B-A3B medium | Qwen | 1 | 6.1 | $1.140 | 11/22 | 110.8s |
| #139 | Gemini 3.5 Flash none | 4 | 6.9 | $1.093 | 14/22 | 10.2s | |
| #81 | Seed-2.0-Code low | Bytedance Seed | 2 | 7.7 | $0.767 | 13/22 | 72.2s |
| #129 | GLM 5.1 medium | Z.ai | 1 | 7.0 | $0.727 | 12/22 | 58.8s |
| #54 | Muse Spark 1.3 low | Meta | 1 | 8.2 | $0.689 | 15/22 | 16.0s |
| #102 | Kimi K2.7 Code medium | Moonshot AI | 1 | 7.4 | $0.687 | 11/22 | 80.1s |
| #204 | Mimo V2 Omni medium | Xiaomi | 1 | 5.9 | $0.683 | 10/21 | 41.2s |
| #162 | Qwen3.6 35B A3B medium | Qwen | 2 | 6.6 | $0.672 | 12/22 | 58.5s |
| #194 | Trinity Large Thinking low | Arcee AI | 2 | 6.0 | $0.625 | 8/22 | 96.6s |