API خرابی ناکامیاں
دیکھیں کہ کن AI ماڈلز میں API خرابی سب سے زیادہ ہوتا ہے، تاکہ آپ انتخاب سے پہلے قابلِ اعتماد ہونے کے خطرات سمجھ سکیں۔
94/94
ماڈلز فلٹر کریں
موجودہ تلاش اور فلٹرز سے کوئی ماڈل مطابقت نہیں رکھتا۔
| درجہ | ماڈل | کمپنی | API خرابی کی تعداد | اسکور | کل لاگت | درست ٹیسٹس | ردِعمل کا وقت (اوسط) |
|---|---|---|---|---|---|---|---|
| #62 | DeepSeek V4 Flash 0731 high | DeepSeek | 1 | 8.0 | $0.084 | 14/22 | 114.9s |
| #64 | Inkling medium | Thinkingmachines | 1 | 8.0 | $0.383 | 15/22 | 15.7s |
| #67 | GPT-5.2 Chat none | OpenAI | 1 | 7.9 | $0.594 | 13/22 | 7.73s |
| #71 | Qwen3.6 Plus medium | Qwen | 1 | 7.8 | $0.418 | 15/22 | 45.5s |
| #76 | Qwen3.8 27B medium | Qwen | 1 | 7.8 | ~$0.058 | 14/22 | 33.0s |
| #83 | DeepSeek V4 Pro high | DeepSeek | 1 | 7.7 | $0.489 | 10/22 | 92.5s |
| #88 | Nemotron 3 Ultra medium | NVIDIA | 1 | 7.6 | $0.567 | 13/22 | 33.6s |
| #93 | GPT 5.3 Chat none | OpenAI | 1 | 7.5 | $0.533 | 13/22 | 6.56s |
| #94 | Qwen3.5 Plus 2026-02-15 medium | Qwen | 1 | 7.5 | $0.459 | 14/22 | 91.8s |
| #96 | Mercury 2.5 Preview medium | Inception | 1 | 7.5 | $0.024 | 15/22 | 3.58s |
| #102 | Kimi K2.7 Code medium | Moonshot AI | 1 | 7.4 | $0.687 | 11/22 | 80.1s |
| #104 | LongCat 2.0 medium | Meituan | 1 | 7.4 | $0.499 | 12/22 | 143.6s |
| #110 | KAT-Coder-Pro V2.5 low | Kwaipilot | 1 | 7.3 | $0.400 | 11/22 | 20.2s |
| #120 | Qwen3.7 Flash low | Qwen | 1 | 7.2 | $0.043 | 11/22 | 38.0s |
| #125 | Solar Pro 4 high | Upstage | 1 | 7.1 | $0.046 | 11/22 | 120.6s |