AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com
#359

Claude Opus 5.5

Anthropic اجرا: 2026-09-23 ٹیسٹ کیا گیا: 2026-09-23 01:51 anthropic/claude-opus-5.5::none
~5T کل (~500B فعال)MoEبند ماخذتخمینہ

خلاصہ

Claude Opus 5.5 AI BENCHY پر 1.8 اسکور کرتا ہے اور #359 پر ہے۔ اس کی reliability 10.0، pass rate 4.6%، کل لاگت $0.015، اور اوسط response time 13.58s ہے۔

Claude Opus 5.5 کو منفرد کیا بناتا ہے: اس score range کے لیے اس کی کل benchmark لاگت غیر معمولی طور پر کم ہے۔

آرکائیو شدہ ماڈل: اس ماڈل کو اب اپ ڈیٹ نہیں کیا جائے گا اور نئے ٹیسٹس پر ٹیسٹ نہیں کیا جائے گا

ماڈل کی تفصیلات

تحقیق کی تاریخ: 2026-09-23

تخمینہ
پیرامیٹرز
~5T کل (~500B فعال)
ساخت
MoE
دستیابی
بند ماخذ
لائسنس
-

عوامی شواہد کی بنیاد پر بہترین تخمینہ؛ فراہم کنندہ نے تمام اقدار ظاہر نہیں کیں۔

تسلسل

5.0

کل آؤٹ پٹ ٹوکنز

735

کل ان پٹ ٹوکنز

73

ان پٹ قیمت

$4.000 / 1M

آؤٹ پٹ قیمت

$20.000 / 1M

درست ٹیسٹس

غلط ٹیسٹس: 0

فی کوشش کامیابی کی شرح: 4.6%

غیر مستحکم ٹیسٹ

0

غیر مستحکم ٹیسٹس میں رنز کے درمیان ملے جلے نتائج آئے (کم از کم ایک کامیاب اور ایک ناکام).

ردِعمل کا وقت (اوسط)

13.58s

ردِعمل کا وقت (زیادہ سے زیادہ): 13.58s

ردِعمل کا وقت (کل): 13.58s

چارٹس

پہلا ماڈل منتخب کریں، پھر دوسرا ماڈل کلک کریں تاکہ سائیڈ بائی سائیڈ صفحہ کھلے۔

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

زمرہ اسکور تسلسل درست ٹیسٹس
اینٹی اے آئی چالیں 0.0 0.0
کوڈنگ 0.0 0.0
مشترکہ 0.0 0.0
ڈیٹا پارسنگ اور استخراج 0.0 0.0
ڈومین مخصوص 3.3 3.3
عمومی ذہانت 0.0 0.0
ہدایات کی پیروی 0.0 0.0
پہیلی حل کرنا 0.0 0.0
ٹول کالنگ 0.0 0.0
معلومات عامہ 0.0 0.0

موازنہ کیے گئے ماڈلز