- रैंक
- #30
- कुल आउटपुट टोकन
- 27,194
- प्रतिक्रिया समय (औसत)
- 24.18s
- कुल लागत
- $1.080
Claude Opus 5.5 (medium) vs Qwen3.8 Max (0902) (high)
Claude Opus 5.5 (medium) average score में आगे है: 9.0 vs 8.9. Claude Opus 5.5 (medium) की benchmark लागत कम है: $1.080 vs $2.736. Claude Opus 5.5 (medium) तेज है: 24.18s vs 185.56s, pass rates 89.4% vs 86.4%.
तुलना किए गए मॉडल
- रैंक
- #36
- कुल आउटपुट टोकन
- 419,443
- प्रतिक्रिया समय (औसत)
- 185.56s
- कुल लागत
- $2.736
अनुशंसित मॉडल
Claude Opus 5.5 (medium)
It has the best score here (9.0), while costing about 2.5x less than Qwen3.8 Max (0902) (high).
विस्तृत तुलना
| मेट्रिक | Claude Opus 5.5 Claude Opus 5.5 medium | Qwen3.8 Max (0902) Qwen3.8 Max (0902) high |
|---|---|---|
| स्कोर | 9.0 | 8.9 |
| रैंक | #30 | #36 |
| विश्वसनीयता | 10.0 | 9.8 |
| संगति | 9.6 | 9.0 |
| प्रयास | 66/66 | 66/66 |
| सही परीक्षण | ||
| प्रति प्रयास पास दर | 89.4% | 86.4% |
| अस्थिर टेस्ट | 1 | 3 |
| कुल रन | 66 | 66 |
| प्रति परिणाम लागत | 5.683 | 16.089 |
| कुल लागत | $1.080 | $2.736 |
| इनपुट कीमत | $4.000 / 1M | $2.000 / 1M |
| आउटपुट कीमत | $20.000 / 1M | $6.000 / 1M |
| कुल इनपुट टोकन | 133,954 | 109,226 |
| आउटपुट टोकन | 7,292 | 6,890 |
| रीजनिंग टोकन | 19,902 | 412,553 |
| प्रतिक्रिया समय (औसत) | 24.18s | 185.56s |
| प्रतिक्रिया समय (अधिकतम) | 90.20s | 912.78s |
| प्रतिक्रिया समय (कुल) | 532.04s | 4082.41s |
| पैरामीटर | ~5T कुल (~500B सक्रिय) | 2.4T कुल (~100B सक्रिय) |
| उपलब्धता | बंद स्रोत | बंद स्रोत |
मॉडल जनरेशन शोकेस
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#30 Claude Opus 5.5
medium- लागत
- $0.053
- समय
- 25.6s
- टोकन
- 2,781 tok
#36 Qwen3.8 Max (0902)
high
Reached the allocated time limit (600 seconds) without receiving showcase output.
- लागत
- $0.000
- समय
- 600.0s
- टोकन
- 0 tok
स्कोर के अनुसार शीर्ष मॉडल
स्कोर बनाम कुल लागत
प्रतिक्रिया समय (औसत)
स्कोर vs प्रतिक्रिया समय (औसत)
कुल आउटपुट टोकन
स्कोर vs कुल आउटपुट टोकन
श्रेणी विवरण
| एंटी-एआई ट्रिक्स | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5 | 10.0 | 10.0 | 100.0% | 0 | 12.42s | 858 | 321 | 657 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 15.86s | 1,128 | 263 | 6,631 |
| कोडिंग | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5 | 8.4 | 7.4 | 88.9% | 1 | 13.50s | 10,608 | 636 | 4,341 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 253.22s | 8,235 | 418 | 91,734 |
| संयुक्त | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5 | 10.0 | 10.0 | 100.0% | 0 | 55.69s | 96,679 | 4,639 | 4,527 | |
| Qwen3.8 Max (0902) | 8.7 | 6.9 | 83.3% | 1 | 110.39s | 79,527 | 5,215 | 28,102 |
| डेटा पार्सिंग और निष्कर्षण | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5 | 10.0 | 10.0 | 100.0% | 0 | 12.65s | 10,515 | 312 | 277 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 16.37s | 8,010 | 261 | 3,598 |
| डोमेन-विशिष्ट | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5 | 7.7 | 10.0 | 66.7% | 0 | 21.35s | 990 | 61 | 8,360 | |
| Qwen3.8 Max (0902) | 5.9 | 7.2 | 55.6% | 1 | 658.46s | 842 | 31 | 154,450 |
| Samanya Buddhimatta | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5 | 10.0 | 10.0 | 100.0% | 0 | 6.17s | 714 | 273 | 326 | |
| Qwen3.8 Max (0902) | 6.5 | 3.4 | 66.7% | 1 | 75.11s | 630 | 80 | 8,110 |
| निर्देश पालन | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5 | 10.0 | 10.0 | 100.0% | 0 | 21.33s | 921 | 96 | 336 | |
| Qwen3.8 Max (0902) | 9.8 | 10.0 | 100.0% | 0 | 7.55s | 927 | 86 | 1,823 |
| पहेली समाधान | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5 | 10.0 | 10.0 | 100.0% | 0 | 30.12s | 912 | 513 | 491 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 134.14s | 1,038 | 268 | 47,351 |
| टूल कॉलिंग | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5 | 10.0 | 10.0 | 100.0% | 0 | 74.20s | 11,757 | 441 | 587 | |
| Qwen3.8 Max (0902) | 10.0 | 10.0 | 100.0% | 0 | 5.21s | 8,571 | 249 | 243 |
| सामान्य ज्ञान | स्कोर | संगति | प्रति प्रयास पास दर | अस्थिर टेस्ट | सही परीक्षण | प्रतिक्रिया समय (औसत) | इनपुट टोकन | आउटपुट टोकन | रीजनिंग टोकन |
|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5 | 3.0 | 10.0 | 0.0% | 0 | 27.75s | 0 | 0 | 0 | |
| Qwen3.8 Max (0902) | 3.0 | 10.0 | 0.0% | 0 | 532.59s | 318 | 19 | 70,511 |
त्वरित तुलना
तुलना जोड़ी बदलें
GPT-5.3-CodexmediumvsQwen3.8 Max (0902)highQwen3.8 Max (0902)highvsParetononeClaude Opus 5.5mediumvsGrok 4.5highGPT-5.5mediumvsQwen3.8 Max (0902)highGemini 3.5 FlashmediumvsQwen3.8 Max (0902)highClaude Opus 5.5mediumvsSeed 2.1 TurbolowClaude Opus 5.5mediumvsMuse Spark 1.3highClaude Opus 5.5mediumvsQwen3.8 Max (0902)lowClaude Opus 5.5mediumvsParetononeClaude Opus 5.5mediumvsSeed 2.1 TurbohighGemini 3.5 FlashlowvsQwen3.8 Max (0902)highSeed 2.1 TurbolowvsQwen3.8 Max (0902)high