- स्कोर
- 8.6 (+0.26 अंक)
- कुल लागत (वर्तमान कीमत)
- $0.061 · 30.9% सस्ता
- प्रतिक्रिया समय (औसत)
- 7.51s · 27.8% तेज़
सारांश
Claude Haiku 5.5 AI BENCHY पर 8.3 स्कोर करता है और #80 पर है। इसकी reliability 10.0, pass rate 76.8%, कुल लागत $0.088, और औसत response time 10.41s है।
Claude Haiku 5.5 को अलग क्या बनाता है: यह समान मॉडलों की तुलना में काफ़ी तेज है।
सुझाए गए विकल्प
हम इसकी जगह यह मॉडल चुनने की सलाह देते हैं:
मॉडल विवरण
शोध की तारीख: 2026-10-07
- पैरामीटर
- ~50B
- आर्किटेक्चर
- सघन
- उपलब्धता
- बंद स्रोत
- लाइसेंस
- -
सार्वजनिक साक्ष्यों पर आधारित सर्वोत्तम अनुमान; प्रदाता ने सभी मान जारी नहीं किए हैं।
8.3
संगति
8.5
10.0
$0.088
कुल आउटपुट टोकन
105,640
कुल इनपुट टोकन
346,451
इनपुट कीमत
$0.100 / 1M
आउटपुट कीमत
$0.500 / 1M
कैश पढ़ने की कीमत
$0.010 / 1M
कैश लिखने की कीमत
$0.125 / 1M
कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।
अस्थिर टेस्ट
4
अस्थिर टेस्ट में रनों के बीच मिले-जुले परिणाम रहे (कम से कम एक पास और एक फेल)।
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#80 Claude Haiku 5.5
high- लागत
- $0.003
- समय
- 28.0s
- टोकन
- 5,775 tok
चार्ट
पहले मॉडल चुनें, फिर दूसरा मॉडल क्लिक करके साइड-बाय-साइड पेज खोलें।
स्कोर के अनुसार शीर्ष मॉडल
स्कोर vs कुल लागत
प्रतिक्रिया समय (औसत)
स्कोर vs प्रतिक्रिया समय (औसत)
कुल आउटपुट टोकन
स्कोर vs कुल आउटपुट टोकन
त्वरित तुलना
श्रेणी विवरण
| श्रेणी | स्कोर | संगति | सही परीक्षण |
|---|---|---|---|
| स्वायत्त एजेंट कार्य | 10.0 | 10.0 | |
| एंटी-एआई ट्रिक्स | 10.0 | 10.0 | |
| कोडिंग | 6.0 | 7.2 | |
| संयुक्त | 10.0 | 10.0 | |
| डेटा पार्सिंग और निष्कर्षण | 10.0 | 10.0 | |
| डोमेन-विशिष्ट | 4.1 | 4.4 | |
| Samanya Buddhimatta | 10.0 | 10.0 | |
| निर्देश पालन | 9.9 | 10.0 | |
| पहेली समाधान | 5.9 | 7.2 | |
| टूल कॉलिंग | 10.0 | 10.0 | |
| सामान्य ज्ञान | 3.0 | 10.0 |