مشترکہ: کوئی جواب نہیں
مشترکہ
کوئی جواب نہیں
دیکھیں کہ مشترکہ میں کن AI ماڈلز کو کوئی جواب نہیں پیش آنے کا سب سے زیادہ امکان ہے، تاکہ آپ کمزوریاں جلدی پہچان سکیں۔ ترتیب دیں حسب: کل لاگت ↓.
ناکامی کی وجوہات
29/29
ماڈلز فلٹر کریں
موجودہ تلاش اور فلٹرز سے کوئی ماڈل مطابقت نہیں رکھتا۔
| درجہ | ماڈل | کمپنی | کوئی جواب نہیں کی تعداد | زمرہ اسکور | کل لاگت | درست ٹیسٹس | ردِعمل کا وقت (اوسط) |
|---|---|---|---|---|---|---|---|
| #119 | Qwen3.5-35B-A3B medium | Qwen | 1 | 3.8 | $0.837 | 0/2 | 512.8s |
| #73 | Grok 4.3 medium | X AI | 1 | 6.5 | $0.779 | 1/2 | 55.1s |
| #30 | GPT-5.2 Chat none | OpenAI | 1 | 7.3 | $0.604 | 1/2 | 13.9s |
| #112 | Claude Sonnet 5 none | Anthropic | 1 | 6.5 | $0.548 | 1/2 | 31.4s |
| #32 | Inkling medium | Thinkingmachines | 1 | 7.3 | $0.391 | 1/2 | 41.2s |
| #132 | GPT-5.6 Terra none | OpenAI | 1 | 2.9 | $0.349 | 0/2 | 7.02s |
| #190 | MiniMax M2.5 medium | Minimax | 1 | 3.7 | $0.340 | 0/2 | 83.2s |
| #26 | GPT-5 Mini medium | OpenAI | 1 | 7.3 | $0.237 | 1/2 | 99.8s |
| #35 | Seed-2.0-Lite medium | Bytedance Seed | 1 | 6.4 | $0.234 | 1/2 | 58.5s |
| #138 | Kimi K2.6 none | Moonshot AI | 1 | 3.0 | $0.184 | 0/2 | 77.8s |
| #151 | GLM 5.1 none | Z.ai | 1 | 2.8 | $0.164 | 0/2 | 46.9s |
| #172 | MiniMax M2.7 medium | Minimax | 1 | 3.8 | $0.163 | 0/2 | 72.1s |
| #155 | Kimi K2.5 none | Moonshot AI | 1 | 2.8 | $0.127 | 0/2 | 61.0s |
| #128 | GPT-5 Nano medium | OpenAI | 1 | 6.4 | $0.114 | 1/2 | 146.9s |
| #80 | Seed-2.0-Mini medium | Bytedance Seed | 1 | 7.3 | $0.101 | 1/2 | 282.3s |