#111 LongCat 2.0
none- لاگت
- $0.027
- وقت
- 411.7s
- ٹوکنز
- 22,283 tok
خلاصہ
LongCat 2.0 AI BENCHY پر 6.3 اسکور کرتا ہے اور #111 پر ہے۔ اس کی reliability 10.0، pass rate 36.4%، کل لاگت $0.044، اور اوسط response time 5.18s ہے۔
LongCat 2.0 کو منفرد کیا بناتا ہے: اس score range کے لیے اس کی کل benchmark لاگت غیر معمولی طور پر کم ہے۔
شناختی نوٹ
Owl Alpha، LongCat 2.0 کا خفیہ ورژن تھا۔
تحقیق کی تاریخ: 2026-08-12
6.3
تسلسل
9.3
10.0
$0.044
کل آؤٹ پٹ ٹوکنز
9,372
کل ان پٹ ٹوکنز
108,743
ان پٹ قیمت
$0.300 / 1M
آؤٹ پٹ قیمت
$1.200 / 1M
غیر مستحکم ٹیسٹ
2
غیر مستحکم ٹیسٹس میں رنز کے درمیان ملے جلے نتائج آئے (کم از کم ایک کامیاب اور ایک ناکام).
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
رن ہسٹری
| ٹیسٹ کیا گیا | اسکور | اعتماد پذیری | درست ٹیسٹس | کل لاگت | موازنہ کریں |
|---|---|---|---|---|---|
| 2026-08-14 03:58 دوبارہ ٹیسٹ | 6.4 | 10.0 | $0.044 | موازنہ کریں | |
| 2026-07-20 16:55 پہلا رن | 6.3 | 10.0 | $0.044 | موجودہ رن |
قیمت کی تاریخ
OpenRouter سے اس ماڈل کے تاریخی قیمت کے اعداد و شمار۔
| تاریخ | ان پٹ قیمت | آؤٹ پٹ قیمت |
|---|---|---|
| 2026-07-20 17:49 | $0.300 / 1M | $1.200 / 1M |
پہلا ماڈل منتخب کریں، پھر دوسرا ماڈل کلک کریں تاکہ سائیڈ بائی سائیڈ صفحہ کھلے۔
| زمرہ | اسکور | تسلسل | درست ٹیسٹس |
|---|---|---|---|
| اینٹی اے آئی چالیں | 4.8 | 10.0 | |
| کوڈنگ | 5.5 | 10.0 | |
| مشترکہ | 6.5 | 10.0 | |
| ڈیٹا پارسنگ اور استخراج | 10.0 | 10.0 | |
| ڈومین مخصوص | 3.0 | 10.0 | |
| عمومی ذہانت | 5.0 | 10.0 | |
| ہدایات کی پیروی | 6.5 | 10.0 | |
| پہیلی حل کرنا | 4.0 | 5.0 | |
| ٹول کالنگ | 10.0 | 10.0 | |
| معلومات عامہ | 3.0 | 10.0 |