- रैंक
- #35
- कुल आउटपुट टोकन
- 199,268
- प्रतिक्रिया समय (औसत)
- 16.58s
- कुल लागत
- $0.140
Claude Haiku 5.5 (xhigh) vs Qwen3.8 MAX (medium)
Qwen3.8 MAX (medium) average score में आगे है: 9.2 vs 9.1. Claude Haiku 5.5 (xhigh) की benchmark लागत कम है: $0.140 vs $1.181. Claude Haiku 5.5 (xhigh) तेज है: 16.58s vs 27.34s, pass rates 81.2% vs 81.2%.
तुलना किए गए मॉडल
- रैंक
- #32
- कुल आउटपुट टोकन
- 104,596
- प्रतिक्रिया समय (औसत)
- 27.34s
- कुल लागत
- $1.181
अनुशंसित मॉडल
Claude Haiku 5.5 (xhigh)
Its score stays close to the best score here (9.1 vs 9.2), while costing about 8.5x less than Qwen3.8 MAX (medium).
विस्तृत तुलना
| मेट्रिक | Claude Haiku 5.5 Claude Haiku 5.5 xhigh | Qwen3.8 MAX Qwen3.8 MAX medium |
|---|---|---|
| स्कोर | 9.1 | 9.2 |
| रैंक | #35 | #32 |
| विश्वसनीयता | 10.0 | 10.0 |
| संगति | 9.3 | 9.7 |
| प्रयास | 69/69 | 69/69 |
| सही परीक्षण | ||
| प्रति प्रयास पास दर | 81.2% | 81.2% |
| अस्थिर टेस्ट | 2 | 1 |
| कुल रन | 69 | 69 |
| प्रति परिणाम लागत | 0.773 | 5.266 |
| कुल लागत | $0.140 | $1.181 |
| इनपुट कीमत | $0.100 / 1M | $2.000 / 1M |
| आउटपुट कीमत | $0.500 / 1M | $6.000 / 1M |
| कैश पढ़ने की कीमत | $0.010 / 1M | लागू नहीं |
| कैश लिखने की कीमत | $0.125 / 1M | लागू नहीं |
| कुल इनपुट टोकन | 394,509 | 276,512 |
| आउटपुट टोकन | 10,349 | 8,152 |
| रीजनिंग टोकन | 188,919 | 96,444 |
| प्रतिक्रिया समय (औसत) | 16.58s | 27.34s |
| प्रतिक्रिया समय (अधिकतम) | 92.74s | 126.60s |
| प्रतिक्रिया समय (कुल) | 381.40s | 628.75s |
| पैरामीटर | ~50B | 2.4T कुल (~100B सक्रिय) |
| उपलब्धता | बंद स्रोत | बंद स्रोत |
कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।
मॉडल जनरेशन शोकेस
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#35 Claude Haiku 5.5
xhigh- लागत
- $0.021
- समय
- 189.0s
- टोकन
- 41,343 tok
#32 Qwen3.8 MAX
medium- लागत
- $0.028
- समय
- 71.9s
- टोकन
- 4,750 tok
श्रेणी विवरण
| स्वायत्त एजेंट कार्य | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 62.72s | 257,002 | 2,786 | 14,500 | |
| Qwen3.8 MAX | 10.0 | 10.0 | 100.0% | 0 | 115.27s | 167,457 | 1,586 | 10,963 |
| एंटी-एआई ट्रिक्स | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 2.88s | 858 | 367 | 3,017 | |
| Qwen3.8 MAX | 10.0 | 10.0 | 100.0% | 0 | 4.17s | 672 | 312 | 2,075 |
| कोडिंग | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 13.13s | 10,608 | 504 | 26,396 | |
| Qwen3.8 MAX | 10.0 | 10.0 | 100.0% | 0 | 41.35s | 7,893 | 430 | 23,804 |
| संयुक्त | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 38.95s | 99,968 | 4,903 | 45,341 | |
| Qwen3.8 MAX | 8.7 | 6.9 | 83.3% | 1 | 91.25s | 81,584 | 4,526 | 30,688 |
| डेटा पार्सिंग और निष्कर्षण | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 3.65s | 10,515 | 312 | 2,656 | |
| Qwen3.8 MAX | 10.0 | 10.0 | 100.0% | 0 | 8.72s | 7,782 | 270 | 2,519 |
| डोमेन-विशिष्ट | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 5.3 | 7.2 | 44.4% | 1 | 47.83s | 990 | 65 | 83,800 | |
| Qwen3.8 MAX | 3.0 | 10.0 | 0.0% | 0 | 41.77s | 780 | 62 | 20,803 |
| Samanya Buddhimatta | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 5.0 | 10.0 | 0.0% | 0 | 9.80s | 714 | 155 | 4,341 | |
| Qwen3.8 MAX | 10.0 | 10.0 | 100.0% | 0 | 6.41s | 516 | 168 | 700 |
| निर्देश पालन | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 3.34s | 921 | 100 | 1,775 | |
| Qwen3.8 MAX | 10.0 | 10.0 | 100.0% | 0 | 3.49s | 699 | 102 | 914 |
| पहेली समाधान | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 7.6 | 7.2 | 77.8% | 1 | 3.80s | 912 | 563 | 4,066 | |
| Qwen3.8 MAX | 10.0 | 10.0 | 100.0% | 0 | 4.93s | 696 | 401 | 1,575 |
| टूल कॉलिंग | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 10.0 | 10.0 | 100.0% | 0 | 6.42s | 11,757 | 354 | 1,285 | |
| Qwen3.8 MAX | 10.0 | 10.0 | 100.0% | 0 | 7.83s | 8,229 | 267 | 636 |
| सामान्य ज्ञान | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| Claude Haiku 5.5 | 3.0 | 10.0 | 0.0% | 0 | 4.79s | 264 | 240 | 1,742 | |
| Qwen3.8 MAX | 3.0 | 10.0 | 0.0% | 0 | 11.49s | 204 | 28 | 1,767 |
त्वरित तुलना
तुलना जोड़ी बदलें
Claude Sonnet 5.5maxvsQwen3.8 MAXmediumClaude Haiku 5.5xhighvsGPT-5.3-CodexmediumClaude Haiku 5.5xhighvsMuse Spark 1.3highClaude Haiku 5.5xhighvsQwen3.8 Max (0902)highClaude Haiku 5.5xhighvsParetodefaultClaude Haiku 5.5xhighvsSeed 2.1 TurbohighMuse Spark 1.3highvsQwen3.8 MAXmediumClaude Haiku 5.5xhighvsGPT-5.5mediumQwen3.8 MAXmediumvsParetodefaultSeed 2.1 TurbohighvsQwen3.8 MAXmediumSeed 2.1 TurbolowvsQwen3.8 MAXmediumClaude Haiku 5.5xhighvsGemini 3.5 Flashlow