#64 Claude Haiku 5.5
low- खर्च
- $0.001
- वेळ
- 7.4s
- टोकन्स
- 1,851 tok
सारांश
Claude Haiku 5.5 AI BENCHY वर 8.6 स्कोर करते आणि #64 वर आहे. याची reliability 10.0, pass rate 76.8%, एकूण खर्च $0.061, आणि सरासरी response time 7.51s आहे.
Claude Haiku 5.5 खास का आहे: हे डोमेन-विशिष्ट मध्ये सर्वाधिक उठून दिसते, जिथे त्याचा rank #1 आहे; तर Samanya Buddhimatta हा सर्वात कमकुवत भाग आहे, rank #15. या score range साठी एकूण benchmark खर्च असामान्यपणे कमी आहे. समान मॉडेल्सच्या तुलनेत हे लक्षणीय वेगवान आहे.
संशोधन दिनांक: 2026-10-07
सार्वजनिक पुराव्यावर आधारित सर्वोत्तम अंदाज; प्रदात्याने सर्व मूल्ये जाहीर केलेली नाहीत.
8.6
सुसंगतता
8.9
10.0
$0.061
एकूण आउटपुट टोकन्स
61,650
एकूण इनपुट टोकन्स
296,301
इनपुट किंमत
$0.100 / 1M
आउटपुट किंमत
$0.500 / 1M
कॅश वाचण्याची किंमत
$0.010 / 1M
कॅश लिहिण्याची किंमत
$0.125 / 1M
कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.
अस्थिर चाचण्या
3
अस्थिर चाचण्यांत रन्समध्ये मिश्र निकाल असतात (किमान एक पास आणि एक फेल).
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
पहिले मॉडेल निवडा, नंतर दुसरे मॉडेल क्लिक करून बाजू-बाजूची तुलना पेज उघडा.
| श्रेणी | स्कोअर | सुसंगतता | बरोबर चाचण्या |
|---|---|---|---|
| स्वायत्त एजंट कार्ये | 10.0 | 10.0 | |
| अँटी-एआय युक्त्या | 8.7 | 7.9 | |
| कोडिंग | 7.9 | 7.5 | |
| संयुक्त | 10.0 | 10.0 | |
| डेटा पार्सिंग आणि निष्कर्षण | 10.0 | 10.0 | |
| डोमेन-विशिष्ट | 5.9 | 7.2 | |
| Samanya Buddhimatta | 4.6 | 9.8 | |
| सूचनांचे पालन | 9.8 | 10.0 | |
| कोडी सोडवणे | 7.7 | 10.0 | |
| टूल कॉलिंग | 10.0 | 10.0 | |
| सामान्य ज्ञान | 3.0 | 10.0 |