کوڈنگ: کوئی جواب نہیں
کوڈنگ
کوئی جواب نہیں
دیکھیں کہ کوڈنگ میں کن AI ماڈلز کو کوئی جواب نہیں پیش آنے کا سب سے زیادہ امکان ہے، تاکہ آپ کمزوریاں جلدی پہچان سکیں۔ ترتیب دیں حسب: کل لاگت ↓.
ناکامی کی وجوہات
31/31
ماڈلز فلٹر کریں
موجودہ تلاش اور فلٹرز سے کوئی ماڈل مطابقت نہیں رکھتا۔
| درجہ | ماڈل | کمپنی | کوئی جواب نہیں کی تعداد | زمرہ اسکور | کل لاگت | درست ٹیسٹس | ردِعمل کا وقت (اوسط) |
|---|---|---|---|---|---|---|---|
| #48 | Qwen3.8 2.4T A95B low | Qwen | 1 | 7.8 | $2.672 | 2/3 | 172.5s |
| #95 | Qwen3.8 2.4T A95B high | Qwen | 1 | 5.9 | $2.357 | 1/3 | 160.5s |
| #43 | Seed 2.1 Turbo medium | Bytedance Seed | 1 | 8.2 | $1.951 | 2/3 | 354.9s |
| #105 | Kimi K2.6 medium | Moonshot AI | 1 | 5.7 | $1.235 | 1/3 | 214.4s |
| #129 | Step 3.7 Flash high | Stepfun | 2 | 4.0 | $1.229 | 0/3 | 206.2s |
| #170 | Qwen3.5-35B-A3B medium | Qwen | 1 | 5.9 | $1.140 | 1/3 | 206.6s |
| #152 | Qwen3.6 27B medium | Qwen | 1 | 7.7 | $1.045 | 2/3 | 143.0s |
| #150 | Qwen3.6 35B A3B medium | Qwen | 1 | 7.7 | $0.749 | 2/3 | 50.5s |
| #118 | GLM 5.1 medium | Z.ai | 1 | 4.6 | $0.727 | 0/3 | 109.6s |
| #191 | Mimo V2 Omni medium | Xiaomi | 1 | 3.3 | $0.683 | 0/3 | 183.9s |
| #252 | Trinity Large Thinking high | Arcee AI | 1 | 3.7 | $0.624 | 0/3 | 245.0s |
| #123 | Kimi K2.5 medium | Moonshot AI | 1 | 6.1 | $0.479 | 1/3 | 217.5s |
| #77 | GLM 5 Turbo medium | Z.ai | 1 | 8.2 | $0.323 | 2/3 | 45.9s |
| #263 | MiniMax M2.5 medium | Minimax | 1 | 3.4 | $0.273 | 0/3 | 188.6s |
| #242 | MiniMax M2.7 medium | Minimax | 1 | 5.7 | $0.208 | 1/3 | 101.9s |