सारांश
Claude Opus 5.5 AI BENCHY पर 1.8 स्कोर करता है और #359 पर है। इसकी reliability 10.0, pass rate 4.6%, कुल लागत $0.015, और औसत response time 13.58s है।
Claude Opus 5.5 को अलग क्या बनाता है: इस score range के लिए इसकी कुल benchmark लागत असामान्य रूप से कम है।
संग्रहीत मॉडल: इस मॉडल को अब अपडेट नहीं किया जाएगा और नए परीक्षणों में टेस्ट नहीं किया जाएगा।
मॉडल विवरण
शोध की तारीख: 2026-09-23
- पैरामीटर
- ~5T कुल (~500B सक्रिय)
- आर्किटेक्चर
- MoE
- उपलब्धता
- बंद स्रोत
- लाइसेंस
- -
सार्वजनिक साक्ष्यों पर आधारित सर्वोत्तम अनुमान; प्रदाता ने सभी मान जारी नहीं किए हैं।
1.8
संगति
5.0
10.0
$0.015
कुल आउटपुट टोकन
735
कुल इनपुट टोकन
73
इनपुट कीमत
$4.000 / 1M
आउटपुट कीमत
$20.000 / 1M
अस्थिर टेस्ट
0
अस्थिर टेस्ट में रनों के बीच मिले-जुले परिणाम रहे (कम से कम एक पास और एक फेल)।
चार्ट
पहले मॉडल चुनें, फिर दूसरा मॉडल क्लिक करके साइड-बाय-साइड पेज खोलें।
स्कोर vs कुल लागत
प्रतिक्रिया समय (औसत)
स्कोर vs प्रतिक्रिया समय (औसत)
कुल आउटपुट टोकन
स्कोर vs कुल आउटपुट टोकन
श्रेणी विवरण
| श्रेणी | स्कोर | संगति | सही परीक्षण |
|---|---|---|---|
| एंटी-एआई ट्रिक्स | 0.0 | 0.0 | |
| कोडिंग | 0.0 | 0.0 | |
| संयुक्त | 0.0 | 0.0 | |
| डेटा पार्सिंग और निष्कर्षण | 0.0 | 0.0 | |
| डोमेन-विशिष्ट | 3.3 | 3.3 | |
| Samanya Buddhimatta | 0.0 | 0.0 | |
| निर्देश पालन | 0.0 | 0.0 | |
| पहेली समाधान | 0.0 | 0.0 | |
| टूल कॉलिंग | 0.0 | 0.0 | |
| सामान्य ज्ञान | 0.0 | 0.0 |