کوئی جواب نہیں ناکامیاں
دیکھیں کہ کن AI ماڈلز میں کوئی جواب نہیں سب سے زیادہ ہوتا ہے، تاکہ آپ انتخاب سے پہلے قابلِ اعتماد ہونے کے خطرات سمجھ سکیں۔
119/119
ماڈلز فلٹر کریں
موجودہ تلاش اور فلٹرز سے کوئی ماڈل مطابقت نہیں رکھتا۔
| درجہ | ماڈل | کمپنی | کوئی جواب نہیں کی تعداد | اسکور | کل لاگت | درست ٹیسٹس | ردِعمل کا وقت (اوسط) |
|---|---|---|---|---|---|---|---|
| #173 | MiMo-V2.5 medium | Xiaomi | 2 | 6.4 | $0.104 | 11/22 | 46.3s |
| #181 | Claude Sonnet 5 none | Anthropic | 2 | 6.1 | $0.548 | 7/22 | 6.05s |
| #203 | Dots 3 Note Preview medium | Dots Studio | 2 | 5.9 | $0.000 | 8/22 | 67.1s |
| #204 | Mimo V2 Omni medium | Xiaomi | 2 | 5.9 | $0.683 | 10/21 | 41.2s |
| #234 | Laguna S 2.1 medium | Poolside | 2 | 5.4 | $0.053 | 4/22 | 58.4s |
| #240 | Laguna S 2.1 high | Poolside | 2 | 5.4 | $0.114 | 4/22 | 111.6s |
| #259 | MiniMax M2.7 medium | Minimax | 2 | 5.0 | $0.208 | 5/22 | 43.2s |
| #284 | MiniMax M2.5 medium | Minimax | 2 | 4.6 | $0.327 | 5/22 | 69.1s |
| #294 | Laguna Xs.2 medium | Poolside | 2 | 4.1 | $0.015 | 6/19 | 6.73s |
| #2 | Gemini 3.8 Flash high | 1 | 9.9 | $1.595 | 21/22 | 37.2s | |
| #12 | Grok 4.6 high | X AI | 1 | 9.3 | $1.908 | 19/22 | 84.1s |
| #15 | Claude Opus 5 high | Anthropic | 1 | 9.2 | $3.070 | 18/22 | 22.5s |
| #16 | Claude Opus 5 medium | Anthropic | 1 | 9.2 | $1.586 | 18/22 | 10.3s |
| #26 | Muse Spark 1.3 high | Meta | 1 | 8.9 | $1.653 | 16/22 | 52.5s |
| #27 | Seed 2.1 Turbo high | Bytedance Seed | 1 | 8.9 | $1.797 | 16/22 | 174.0s |