کوئی جواب نہیں ناکامیاں
دیکھیں کہ کن AI ماڈلز میں کوئی جواب نہیں سب سے زیادہ ہوتا ہے، تاکہ آپ انتخاب سے پہلے قابلِ اعتماد ہونے کے خطرات سمجھ سکیں۔ ترتیب دیں حسب: کل لاگت ↑.
119/119
ماڈلز فلٹر کریں
موجودہ تلاش اور فلٹرز سے کوئی ماڈل مطابقت نہیں رکھتا۔
| درجہ | ماڈل | کمپنی | کوئی جواب نہیں کی تعداد | اسکور | کل لاگت | درست ٹیسٹس | ردِعمل کا وقت (اوسط) |
|---|---|---|---|---|---|---|---|
| #126 | Grok 4.3 medium | X AI | 1 | 7.0 | $0.741 | 12/22 | 44.2s |
| #165 | Qwen3.6 27B medium | Qwen | 3 | 6.5 | $1.045 | 10/22 | 106.1s |
| #183 | Qwen3.5-35B-A3B medium | Qwen | 3 | 6.1 | $1.140 | 11/22 | 110.8s |
| #115 | Claude Opus 4.8 none | Anthropic | 1 | 7.3 | $1.166 | 13/22 | 4.92s |
| #47 | GPT-5.2 medium | OpenAI | 1 | 8.4 | $1.182 | 14/22 | 28.5s |
| #63 | GLM 5.2 high | Z.ai | 2 | 8.0 | $1.188 | 14/22 | 69.9s |
| #141 | Step 3.7 Flash high | Stepfun | 3 | 6.8 | $1.229 | 11/22 | 70.1s |
| #116 | Kimi K2.6 medium | Moonshot AI | 1 | 7.2 | $1.247 | 12/22 | 115.9s |
| #138 | Seed-2.0-Code high | Bytedance Seed | 1 | 6.9 | $1.273 | 11/22 | 124.2s |
| #18 | Seed 2.1 Turbo low | Bytedance Seed | 2 | 9.1 | $1.546 | 17/22 | 163.9s |
| #89 | Claude Opus 5 none | Anthropic | 1 | 7.5 | $1.550 | 12/22 | 7.65s |
| #16 | Claude Opus 5 medium | Anthropic | 1 | 9.2 | $1.586 | 18/22 | 10.3s |
| #2 | Gemini 3.8 Flash high | 1 | 9.9 | $1.595 | 21/22 | 37.2s | |
| #26 | Muse Spark 1.3 high | Meta | 1 | 8.9 | $1.653 | 16/22 | 52.5s |
| #228 | Hy4 preview low | Tencent | 1 | 5.6 | $1.745 | 3/22 | 214.3s |