नेविगेशन
Advertise here

Claude Opus 5 vs Qwen3.5-27B (medium)

Claude Opus 5 average score में आगे है: 7.5 vs 7.5. Qwen3.5-27B (medium) की benchmark लागत कम है: $0.982 vs $1.550. Claude Opus 5 तेज है: 7.65s vs 113.28s, pass rates 57.6% vs 75.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-07

तुलना किए गए मॉडल

रैंक
#97
कुल आउटपुट टोकन
24,866
प्रतिक्रिया समय (औसत)
7.65s
कुल लागत
$1.550
रैंक
#103
कुल आउटपुट टोकन
614,909
प्रतिक्रिया समय (औसत)
113.28s
कुल लागत
$0.982
अनुशंसित मॉडल Claude Opus 5

It has the best score here (7.5), while responding about 14.8x faster than Qwen3.5-27B (medium).

विस्तृत तुलना

मेट्रिक Claude Opus 5 Claude Opus 5 none रिलीज़: 2026-07-25 Qwen3.5-27B Qwen3.5-27B medium रिलीज़: 2026-02-24
स्कोर 7.5 7.5
रैंक #97 #103
विश्वसनीयता 10.0 10.0
संगति 9.6 7.8
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 57.6% 75.8%
अस्थिर टेस्ट 1 6
कुल रन 66 66
प्रति परिणाम लागत 12.912 8.217
कुल लागत $1.550 $0.982
इनपुट कीमत $5.000 / 1M $0.195 / 1M
आउटपुट कीमत $25.000 / 1M $1.560 / 1M
कुल इनपुट टोकन 185,547 111,644
आउटपुट टोकन 24,866 16,113
रीजनिंग टोकन 0 598,796
प्रतिक्रिया समय (औसत) 7.65s 113.28s
प्रतिक्रिया समय (अधिकतम) 47.72s 1026.43s
प्रतिक्रिया समय (कुल) 168.35s 2492.26s
पैरामीटर ~5T कुल (~500B सक्रिय) 27B
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#97 Claude Opus 5

none
लागत
$0.271
समय
149.3s
टोकन
10,962 tok

#103 Qwen3.5-27B

medium
लागत
$0.008
समय
62.0s
टोकन
3,099 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Opus 5 5.9 9.7 33.3% 0 5.54s 10,590 2,886 0
Qwen3.5-27B 6.2 7.1 55.6% 1 160.69s 7,895 6,381 89,388

त्वरित तुलना

तुलना जोड़ी बदलें