خلاصہ
Tev1 4B Experimental AI BENCHY پر 1.0 اسکور کرتا ہے اور #381 پر ہے۔ اس کی reliability 10.0، pass rate 13.0%، کل لاگت $0.002، اور اوسط response time 498ms ہے۔
Tev1 4B Experimental کو منفرد کیا بناتا ہے: اس score range کے لیے اس کی کل benchmark لاگت غیر معمولی طور پر کم ہے۔ یہ ملتے جلتے models کے مقابلے میں نمایاں طور پر تیز ہے۔
ماڈل کی تفصیلات
تحقیق کی تاریخ: 2026-10-01
- پیرامیٹرز
- 4B
- ساخت
- گنجان
- دستیابی
- وزن دستیاب
- لائسنس
- Pending; see model card
عوامی شواہد کی بنیاد پر بہترین تخمینہ؛ فراہم کنندہ نے تمام اقدار ظاہر نہیں کیں۔
1.0
تسلسل
3.0
10.0
$0.002
کل آؤٹ پٹ ٹوکنز
96
کل ان پٹ ٹوکنز
33,864
ان پٹ قیمت
$0.042 / 1M
آؤٹ پٹ قیمت
$0.000 / 1M
کیش پڑھنے کی قیمت
دستیاب نہیں
کیش میں لکھنے کی قیمت
دستیاب نہیں
کیش کی قیمتیں ان پٹ ٹوکنز پر لاگو ہوتی ہیں۔ پڑھنے سے محفوظ پرامپٹ دوبارہ استعمال ہوتے ہیں؛ لکھنے سے وہ محفوظ ہوتے ہیں اور اضافی لاگت آ سکتی ہے۔ آؤٹ پٹ ٹوکنز پر آؤٹ پٹ کی قیمت لاگو ہوتی ہے۔
غلط ٹیسٹس: 4
فی کوشش کامیابی کی شرح: 13.0%
بینچ مارک کوریج: 21/69 کوششیں. اڈاپٹر انتخاب فراہم کرتے ہیں۔ 7/23 ٹیسٹ معاونت یافتہ ہیں۔ باقی ٹیسٹ غیر معاون ہیں، ناکام نہیں۔ اسکور پورے ٹیسٹ مجموعے پر مبنی ہے۔
غیر مستحکم ٹیسٹ
0
غیر مستحکم ٹیسٹس میں رنز کے درمیان ملے جلے نتائج آئے (کم از کم ایک کامیاب اور ایک ناکام).
چارٹس
پہلا ماڈل منتخب کریں، پھر دوسرا ماڈل کلک کریں تاکہ سائیڈ بائی سائیڈ صفحہ کھلے۔
اسکور vs کل لاگت
ردِعمل کا وقت (اوسط)
اسکور vs ردِعمل کا وقت (اوسط)
کل آؤٹ پٹ ٹوکنز
اسکور vs کل آؤٹ پٹ ٹوکنز
فوری موازنہ
زمرہ وار تفصیل
| زمرہ | اسکور | تسلسل | درست ٹیسٹس |
|---|---|---|---|
| خودمختار ایجنٹ کے کام | 0.0 | 0.0 | |
| اینٹی اے آئی چالیں | 2.5 | 2.5 | |
| کوڈنگ | 0.0 | 0.0 | |
| مشترکہ | 0.0 | 0.0 | |
| ڈیٹا پارسنگ اور استخراج | 3.0 | 10.0 | |
| ڈومین مخصوص | 6.7 | 6.7 | |
| عمومی ذہانت | 0.0 | 0.0 | |
| ہدایات کی پیروی | 1.5 | 5.0 | |
| پہیلی حل کرنا | 1.7 | 3.3 | |
| ٹول کالنگ | 0.0 | 0.0 | |
| معلومات عامہ | 0.0 | 0.0 |