کوئی جواب نہیں ناکامیاں
دیکھیں کہ کن AI ماڈلز میں کوئی جواب نہیں سب سے زیادہ ہوتا ہے، تاکہ آپ انتخاب سے پہلے قابلِ اعتماد ہونے کے خطرات سمجھ سکیں۔ ترتیب دیں حسب: درست ٹیسٹس ↓.
119/119
ماڈلز فلٹر کریں
موجودہ تلاش اور فلٹرز سے کوئی ماڈل مطابقت نہیں رکھتا۔
| درجہ | ماڈل | کمپنی | کوئی جواب نہیں کی تعداد | اسکور | کل لاگت | درست ٹیسٹس | ردِعمل کا وقت (اوسط) |
|---|---|---|---|---|---|---|---|
| #249 | Granite 4.2 8B medium | IBM Granite | 1 | 5.2 | $0.009 | 7/22 | 46.0s |
| #253 | Granite 4.2 8B low | IBM Granite | 1 | 5.1 | $0.012 | 7/22 | 54.4s |
| #294 | Laguna Xs.2 medium | Poolside | 2 | 4.1 | $0.015 | 6/19 | 6.73s |
| #217 | Kimi K2.6 none | Moonshot AI | 1 | 5.7 | $0.233 | 6/22 | 19.6s |
| #243 | Seed-2.0-Code none | Bytedance Seed | 1 | 5.3 | $0.151 | 6/22 | 14.7s |
| #260 | Mercury 2.5 Preview low | Inception | 1 | 5.0 | $0.011 | 6/22 | 1.31s |
| #237 | MiMo-V2.5-Pro none | Xiaomi | 1 | 5.4 | $0.068 | 5/22 | 4.24s |
| #238 | Kimi K2.5 none | Moonshot AI | 1 | 5.4 | $0.101 | 5/22 | 18.0s |
| #252 | Mistral Small 4 medium | Mistral | 1 | 5.1 | $0.097 | 5/22 | 10.8s |
| #254 | Qwen3 Coder Next none | Qwen | 1 | 5.1 | $0.026 | 5/22 | 8.63s |
| #255 | MiMo-V2.5 none | Xiaomi | 1 | 5.1 | $0.025 | 5/22 | 4.68s |
| #259 | MiniMax M2.7 medium | Minimax | 2 | 5.0 | $0.208 | 5/22 | 43.2s |
| #263 | GPT-4o-mini none | OpenAI | 1 | 5.0 | $0.010 | 5/22 | 1.92s |
| #272 | Trinity Large Thinking high | Arcee AI | 1 | 4.8 | $0.592 | 5/22 | 75.9s |
| #284 | MiniMax M2.5 medium | Minimax | 2 | 4.6 | $0.327 | 5/22 | 69.1s |