ڈیٹا پارسنگ اور استخراج: غلط جواب
ڈیٹا پارسنگ اور استخراج
غلط جواب
دیکھیں کہ ڈیٹا پارسنگ اور استخراج میں کن AI ماڈلز کو غلط جواب پیش آنے کا سب سے زیادہ امکان ہے، تاکہ آپ کمزوریاں جلدی پہچان سکیں۔
ناکامی کی وجوہات
59/59
ماڈلز فلٹر کریں
موجودہ تلاش اور فلٹرز سے کوئی ماڈل مطابقت نہیں رکھتا۔
| درجہ | ماڈل | کمپنی | غلط جواب کی تعداد | زمرہ اسکور | کل لاگت | درست ٹیسٹس | ردِعمل کا وقت (اوسط) |
|---|---|---|---|---|---|---|---|
| #270 | Nemotron 3.5 Lightning low | NVIDIA | 1 | 2.9 | $0.140 | 0/2 | 31.3s |
| #271 | GPT-5.4 Nano none | OpenAI | 1 | 6.5 | $0.041 | 1/2 | 1.11s |
| #272 | Trinity Large Thinking high | Arcee AI | 1 | 6.3 | $0.592 | 1/2 | 14.0s |
| #275 | GLM 4.7 Flash none | Z.ai | 1 | 7.3 | $0.016 | 1/2 | 4.82s |
| #280 | Cobuddy medium | Baidu | 1 | 6.3 | $0.000 | 1/2 | 17.4s |
| #281 | Mercury 2 none | Inception | 1 | 7.3 | $0.030 | 1/2 | 667ms |
| #282 | Granite 4.2 8B high | IBM Granite | 1 | 3.8 | $0.084 | 0/2 | 56.5s |
| #283 | Qwen3 Coder Next medium | Qwen | 1 | 6.5 | $0.034 | 1/2 | 81.8s |
| #288 | Elephant Alpha none | Openrouter | 1 | 6.5 | $0.000 | 1/2 | 1.04s |
| #290 | Elephant Alpha medium | Openrouter | 1 | 6.5 | $0.000 | 1/2 | 979ms |
| #300 | Grok Build 0.1 none | X AI | 1 | 3.8 | $0.547 | 0/2 | 9.33s |
| #302 | Ling 3.0 Tiny low | Inclusionai | 1 | 2.8 | $0.000 | 0/2 | 4.82s |
| #305 | Ling 3.0 Tiny medium | Inclusionai | 1 | 2.7 | $0.000 | 0/2 | 4.41s |
| #308 | Nemotron 3 Nano Omni 30b A3b Reasoning medium | NVIDIA | 1 | 7.3 | $0.000 | 1/2 | 2.72s |