مشترکہ: کوئی جواب نہیں
مشترکہ
کوئی جواب نہیں
دیکھیں کہ مشترکہ میں کن AI ماڈلز کو کوئی جواب نہیں پیش آنے کا سب سے زیادہ امکان ہے، تاکہ آپ کمزوریاں جلدی پہچان سکیں۔ ترتیب دیں حسب: ناکامیوں کی تعداد ↑.
ناکامی کی وجوہات
29/29
ماڈلز فلٹر کریں
موجودہ تلاش اور فلٹرز سے کوئی ماڈل مطابقت نہیں رکھتا۔
| درجہ | ماڈل | کمپنی | کوئی جواب نہیں کی تعداد | زمرہ اسکور | کل لاگت | درست ٹیسٹس | ردِعمل کا وقت (اوسط) |
|---|---|---|---|---|---|---|---|
| #26 | GPT-5 Mini medium | OpenAI | 1 | 7.3 | $0.237 | 1/2 | 99.8s |
| #30 | GPT-5.2 Chat none | OpenAI | 1 | 7.3 | $0.604 | 1/2 | 13.9s |
| #32 | Inkling medium | Thinkingmachines | 1 | 7.3 | $0.391 | 1/2 | 41.2s |
| #35 | Seed-2.0-Lite medium | Bytedance Seed | 1 | 6.4 | $0.234 | 1/2 | 58.5s |
| #73 | Grok 4.3 medium | X AI | 1 | 6.5 | $0.779 | 1/2 | 55.1s |
| #80 | Seed-2.0-Mini medium | Bytedance Seed | 1 | 7.3 | $0.101 | 1/2 | 282.3s |
| #89 | Gemini 3 Flash Preview none | 1 | 3.8 | $0.085 | 0/2 | 12.4s | |
| #106 | Gemini 3.1 Flash Lite Preview none | 1 | 3.0 | $0.052 | 0/2 | 6.23s | |
| #112 | Claude Sonnet 5 none | Anthropic | 1 | 6.5 | $0.548 | 1/2 | 31.4s |
| #116 | Seed-2.0-Lite none | Bytedance Seed | 1 | 3.0 | $0.066 | 0/2 | 25.6s |
| #119 | Qwen3.5-35B-A3B medium | Qwen | 1 | 3.8 | $0.837 | 0/2 | 512.8s |
| #120 | Gemini 3.1 Flash Lite minimal | 1 | 3.0 | $0.047 | 0/2 | 7.75s | |
| #122 | Gemini 3.1 Flash Lite none | 1 | 3.0 | $0.046 | 0/2 | 9.49s | |
| #128 | GPT-5 Nano medium | OpenAI | 1 | 6.4 | $0.114 | 1/2 | 146.9s |
| #132 | GPT-5.6 Terra none | OpenAI | 1 | 2.9 | $0.349 | 0/2 | 7.02s |