کوئی جواب نہیں ناکامیاں
دیکھیں کہ کن AI ماڈلز میں کوئی جواب نہیں سب سے زیادہ ہوتا ہے، تاکہ آپ انتخاب سے پہلے قابلِ اعتماد ہونے کے خطرات سمجھ سکیں۔ ترتیب دیں حسب: کل لاگت ↑.
119/119
ماڈلز فلٹر کریں
موجودہ تلاش اور فلٹرز سے کوئی ماڈل مطابقت نہیں رکھتا۔
| درجہ | ماڈل | کمپنی | کوئی جواب نہیں کی تعداد | اسکور | کل لاگت | درست ٹیسٹس | ردِعمل کا وقت (اوسط) |
|---|---|---|---|---|---|---|---|
| #27 | Seed 2.1 Turbo high | Bytedance Seed | 1 | 8.9 | $1.797 | 16/22 | 174.0s |
| #12 | Grok 4.6 high | X AI | 1 | 9.3 | $1.908 | 19/22 | 84.1s |
| #49 | Seed 2.1 Turbo medium | Bytedance Seed | 1 | 8.4 | $1.951 | 15/22 | 193.6s |
| #31 | Claude Opus 4.8 medium | Anthropic | 1 | 8.8 | $1.983 | 17/22 | 13.0s |
| #219 | Gemini 3.1 Flash Lite high | 1 | 5.6 | $2.044 | 10/18 | 62.0s | |
| #78 | Claude Opus 4.8 low | Anthropic | 1 | 7.8 | $2.089 | 16/22 | 12.9s |
| #24 | Grok 4.5 high | X AI | 2 | 9.0 | $2.252 | 17/22 | 72.3s |
| #60 | Muse Spark 1.1 high | Meta | 1 | 8.0 | $2.253 | 12/22 | 36.9s |
| #105 | Qwen3.8 2.4T A95B high | Qwen | 2 | 7.4 | $2.357 | 14/22 | 120.6s |
| #56 | Qwen3.8 2.4T A95B low | Qwen | 2 | 8.1 | $2.672 | 15/22 | 119.0s |
| #52 | Claude Fable 5.1 medium | Anthropic | 2 | 8.3 | $2.909 | 15/22 | 11.7s |
| #39 | Claude Fable 5 medium | Anthropic | 3 | 8.6 | $3.004 | 17/22 | 15.0s |
| #15 | Claude Opus 5 high | Anthropic | 1 | 9.2 | $3.070 | 18/22 | 22.5s |
| #66 | Kimi K3 max | Moonshot AI | 2 | 7.9 | $3.467 | 16/22 | 142.8s |