AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY زمرہ ناکامیاں

عمومی ذہانت: API خرابی

عمومی ذہانت
API خرابی

دیکھیں کہ عمومی ذہانت میں کن AI ماڈلز کو API خرابی پیش آنے کا سب سے زیادہ امکان ہے، تاکہ آپ کمزوریاں جلدی پہچان سکیں۔ ترتیب دیں حسب: ردِعمل کا وقت (اوسط) ↓.

دکھائے گئے ماڈلز

12

کل ناکامیاں

12

سب سے زیادہ متاثر ماڈل

DeepSeek V3.2 1
درجہ ماڈل کمپنی API خرابی کی تعداد زمرہ اسکور درست ٹیسٹس ردِعمل کا وقت (اوسط)
#72 DeepSeek V3.2 medium DeepSeek 1 3.4 0/1 58.3s
#133 DeepSeek V3.2 none DeepSeek 1 4.7 0/1 9.32s
#41 Nemotron 3 Ultra 550b A55b medium NVIDIA 1 3.7 0/1 2.52s
#82 Hy3 preview high Tencent 1 3.0 0/1 0ms
#89 Hy3 preview low Tencent 1 3.0 0/1 0ms
#92 Laguna M.1 medium Poolside 1 3.0 0/1 0ms
#93 Qwen3.6 Plus Preview medium Qwen 1 3.0 0/1 0ms
#107 Laguna Xs.2 medium Poolside 1 3.0 0/1 0ms
#145 Laguna M.1 none Poolside 1 3.0 0/1 0ms
#146 Laguna Xs.2 none Poolside 1 3.0 0/1 0ms
#149 Nemotron 3 Nano Omni 30b A3b Reasoning medium NVIDIA 1 3.0 0/1 0ms
#162 Nemotron 3 Nano Omni 30b A3b Reasoning none NVIDIA 1 3.0 0/1 0ms

API خرابی کی تعداد کے لحاظ سے سرفہرست ماڈلز

API خرابی کی تعداد بمقابلہ اسکور

ردِعمل کا وقت (اوسط) کے لحاظ سے سرفہرست ماڈلز

تخمینی ضائع لاگت کے لحاظ سے سرفہرست ماڈلز