API خرابی ناکامیاں
دیکھیں کہ کن AI ماڈلز میں API خرابی سب سے زیادہ ہوتا ہے، تاکہ آپ انتخاب سے پہلے قابلِ اعتماد ہونے کے خطرات سمجھ سکیں۔ ترتیب دیں حسب: ردِعمل کا وقت (اوسط) ↓.
94/94
ماڈلز فلٹر کریں
موجودہ تلاش اور فلٹرز سے کوئی ماڈل مطابقت نہیں رکھتا۔
| درجہ | ماڈل | کمپنی | API خرابی کی تعداد | اسکور | کل لاگت | درست ٹیسٹس | ردِعمل کا وقت (اوسط) |
|---|---|---|---|---|---|---|---|
| #228 | Hy4 preview low | Tencent | 14 | 5.6 | $1.745 | 3/22 | 214.3s |
| #202 | Step 3.5 Flash medium | Stepfun | 1 | 5.9 | $0.132 | 10/21 | 191.6s |
| #104 | LongCat 2.0 medium | Meituan | 1 | 7.4 | $0.499 | 12/22 | 143.6s |
| #66 | Kimi K3 max | Moonshot AI | 2 | 7.9 | $3.467 | 16/22 | 142.8s |
| #211 | North Mini Code medium | Cohere | 1 | 5.7 | $0.000 | 8/22 | 142.0s |
| #143 | Solar Pro 4 low | Upstage | 1 | 6.8 | $0.044 | 11/22 | 136.1s |
| #144 | Solar Pro 4 medium | Upstage | 1 | 6.8 | $0.047 | 12/22 | 127.6s |
| #138 | Seed-2.0-Code high | Bytedance Seed | 5 | 6.9 | $1.273 | 11/22 | 124.2s |
| #125 | Solar Pro 4 high | Upstage | 1 | 7.1 | $0.046 | 11/22 | 120.6s |
| #62 | DeepSeek V4 Flash 0731 high | DeepSeek | 1 | 8.0 | $0.084 | 14/22 | 114.9s |
| #152 | LongCat 2.0 low | Meituan | 2 | 6.7 | $0.412 | 10/22 | 113.6s |
| #240 | Laguna S 2.1 high | Poolside | 1 | 5.4 | $0.114 | 4/22 | 111.6s |
| #183 | Qwen3.5-35B-A3B medium | Qwen | 1 | 6.1 | $1.140 | 11/22 | 110.8s |
| #304 | Qwen3.5-9B medium | Qwen | 1 | 3.8 | $0.062 | 3/22 | 107.5s |
| #142 | Seed-2.0-Code medium | Bytedance Seed | 6 | 6.8 | $1.153 | 10/22 | 101.1s |