#64 Claude Haiku 5.5
low- लागत
- $0.001
- समय
- 7.4s
- टोकन
- 1,851 tok
सारांश
Claude Haiku 5.5 AI BENCHY पर 8.6 स्कोर करता है और #64 पर है। इसकी reliability 10.0, pass rate 76.8%, कुल लागत $0.061, और औसत response time 7.51s है।
Claude Haiku 5.5 को अलग क्या बनाता है: यह डोमेन-विशिष्ट में सबसे अलग दिखता है, जहाँ इसकी रैंक #1 है; जबकि Samanya Buddhimatta इसकी सबसे कमजोर जगह है, जहाँ यह #15 पर है। इस score range के लिए इसकी कुल benchmark लागत असामान्य रूप से कम है। यह समान मॉडलों की तुलना में काफ़ी तेज है।
शोध की तारीख: 2026-10-07
सार्वजनिक साक्ष्यों पर आधारित सर्वोत्तम अनुमान; प्रदाता ने सभी मान जारी नहीं किए हैं।
8.6
संगति
8.9
10.0
$0.061
कुल आउटपुट टोकन
61,650
कुल इनपुट टोकन
296,301
इनपुट कीमत
$0.100 / 1M
आउटपुट कीमत
$0.500 / 1M
कैश पढ़ने की कीमत
$0.010 / 1M
कैश लिखने की कीमत
$0.125 / 1M
कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।
अस्थिर टेस्ट
3
अस्थिर टेस्ट में रनों के बीच मिले-जुले परिणाम रहे (कम से कम एक पास और एक फेल)।
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
पहले मॉडल चुनें, फिर दूसरा मॉडल क्लिक करके साइड-बाय-साइड पेज खोलें।
| श्रेणी | स्कोर | संगति | सही परीक्षण |
|---|---|---|---|
| स्वायत्त एजेंट कार्य | 10.0 | 10.0 | |
| एंटी-एआई ट्रिक्स | 8.7 | 7.9 | |
| कोडिंग | 7.9 | 7.5 | |
| संयुक्त | 10.0 | 10.0 | |
| डेटा पार्सिंग और निष्कर्षण | 10.0 | 10.0 | |
| डोमेन-विशिष्ट | 5.9 | 7.2 | |
| Samanya Buddhimatta | 4.6 | 9.8 | |
| निर्देश पालन | 9.8 | 10.0 | |
| पहेली समाधान | 7.7 | 10.0 | |
| टूल कॉलिंग | 10.0 | 10.0 | |
| सामान्य ज्ञान | 3.0 | 10.0 |