ڈیٹا پارسنگ اور استخراج: غلط جواب
ڈیٹا پارسنگ اور استخراج
غلط جواب
دیکھیں کہ ڈیٹا پارسنگ اور استخراج میں کن AI ماڈلز کو غلط جواب پیش آنے کا سب سے زیادہ امکان ہے، تاکہ آپ کمزوریاں جلدی پہچان سکیں۔
ناکامی کی وجوہات
59/59
ماڈلز فلٹر کریں
موجودہ تلاش اور فلٹرز سے کوئی ماڈل مطابقت نہیں رکھتا۔
| درجہ | ماڈل | کمپنی | غلط جواب کی تعداد | زمرہ اسکور | کل لاگت | درست ٹیسٹس | ردِعمل کا وقت (اوسط) |
|---|---|---|---|---|---|---|---|
| #135 | KAT-Coder-Pro V2.5 medium | Kwaipilot | 1 | 7.3 | $0.478 | 1/2 | 4.70s |
| #147 | MiMo-V2.5-Pro medium | Xiaomi | 1 | 7.3 | $0.221 | 1/2 | 18.8s |
| #155 | LongCat 2.0 high | Meituan | 1 | 3.6 | $0.492 | 0/2 | 11.0s |
| #170 | Dots 3 Note Preview low | Dots Studio | 1 | 7.3 | $0.000 | 1/2 | 11.5s |
| #171 | Dots 3 Note Preview high | Dots Studio | 1 | 7.3 | $0.000 | 1/2 | 12.7s |
| #173 | MiMo-V2.5 medium | Xiaomi | 1 | 2.7 | $0.104 | 0/2 | 6.33s |
| #174 | Ling-3.0-flash high | Inclusionai | 1 | 7.3 | $0.021 | 1/2 | 7.15s |
| #175 | Ring-2.6-1T medium | Inclusionai | 1 | 6.5 | $0.102 | 1/2 | 37.4s |
| #176 | Mimo V2 PRO medium | Xiaomi | 1 | 7.3 | $0.333 | 1/2 | 17.2s |
| #184 | gpt-oss-120b medium | OpenAI | 1 | 6.4 | $0.020 | 1/2 | 1.98s |
| #189 | Trinity Large Thinking medium | Arcee AI | 1 | 6.3 | $0.756 | 1/2 | 16.4s |
| #194 | Trinity Large Thinking low | Arcee AI | 1 | 7.3 | $0.625 | 1/2 | 14.3s |
| #203 | Dots 3 Note Preview medium | Dots Studio | 1 | 4.5 | $0.000 | 0/2 | 78.5s |
| #208 | Seed 2.1 Turbo none | Bytedance Seed | 1 | 7.1 | $0.092 | 1/2 | 2.63s |
| #220 | KAT-Coder-Air V2.5 high | Kwaipilot | 1 | 6.5 | $0.077 | 1/2 | 3.59s |