کوئی جواب نہیں ناکامیاں
دیکھیں کہ کن AI ماڈلز میں کوئی جواب نہیں سب سے زیادہ ہوتا ہے، تاکہ آپ انتخاب سے پہلے قابلِ اعتماد ہونے کے خطرات سمجھ سکیں۔ ترتیب دیں حسب: درست ٹیسٹس ↑.
119/119
ماڈلز فلٹر کریں
موجودہ تلاش اور فلٹرز سے کوئی ماڈل مطابقت نہیں رکھتا۔
| درجہ | ماڈل | کمپنی | کوئی جواب نہیں کی تعداد | اسکور | کل لاگت | درست ٹیسٹس | ردِعمل کا وقت (اوسط) |
|---|---|---|---|---|---|---|---|
| #238 | Kimi K2.5 none | Moonshot AI | 1 | 5.4 | $0.101 | 5/22 | 18.0s |
| #252 | Mistral Small 4 medium | Mistral | 1 | 5.1 | $0.097 | 5/22 | 10.8s |
| #254 | Qwen3 Coder Next none | Qwen | 1 | 5.1 | $0.026 | 5/22 | 8.63s |
| #255 | MiMo-V2.5 none | Xiaomi | 1 | 5.1 | $0.025 | 5/22 | 4.68s |
| #259 | MiniMax M2.7 medium | Minimax | 2 | 5.0 | $0.208 | 5/22 | 43.2s |
| #263 | GPT-4o-mini none | OpenAI | 1 | 5.0 | $0.010 | 5/22 | 1.92s |
| #272 | Trinity Large Thinking high | Arcee AI | 1 | 4.8 | $0.592 | 5/22 | 75.9s |
| #284 | MiniMax M2.5 medium | Minimax | 2 | 4.6 | $0.327 | 5/22 | 69.1s |
| #217 | Kimi K2.6 none | Moonshot AI | 1 | 5.7 | $0.233 | 6/22 | 19.6s |
| #243 | Seed-2.0-Code none | Bytedance Seed | 1 | 5.3 | $0.151 | 6/22 | 14.7s |
| #260 | Mercury 2.5 Preview low | Inception | 1 | 5.0 | $0.011 | 6/22 | 1.31s |
| #294 | Laguna Xs.2 medium | Poolside | 2 | 4.1 | $0.015 | 6/19 | 6.73s |
| #181 | Claude Sonnet 5 none | Anthropic | 2 | 6.1 | $0.548 | 7/22 | 6.05s |
| #210 | Solar Pro 4 none | Upstage | 1 | 5.8 | $0.006 | 7/22 | 5.37s |
| #249 | Granite 4.2 8B medium | IBM Granite | 1 | 5.2 | $0.009 | 7/22 | 46.0s |