नेविगेशन
AI BENCHY
Advertise here

Claude Opus 5 vs Qwen: Qwen3.5-27B

Claude Opus 5 average score में आगे है: 7.5 vs 7.4. Qwen3.5-27B (medium) की benchmark लागत कम है: $0.981 vs $1.550. Claude Opus 5 तेज है: 7.60s vs 111.94s, pass rates 57.6% vs 72.7%.

अनुशंसित मॉडलClaude Opus 5It has the best score here (7.5), while responding about 14.7x faster than Qwen3.5-27B (medium).

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

मेट्रिक Claude Opus 5 Claude Opus 5 none रिलीज़: 2026-07-25 Qwen3.5-27B Qwen3.5-27B medium रिलीज़: 2026-02-24
स्कोर 7.5 7.4
रैंक #59 #66
विश्वसनीयता 10.0 10.0
संगति 9.6 8.2
सही परीक्षण
प्रति प्रयास पास दर 57.6% 72.7%
अस्थिर टेस्ट 1 5
कुल रन 66 66
प्रति परिणाम लागत 12.912 8.324
कुल लागत $1.550 $0.981
इनपुट कीमत $5.000 / 1M $0.195 / 1M
आउटपुट कीमत $25.000 / 1M $1.560 / 1M
कुल इनपुट टोकन 185,550 111,635
आउटपुट टोकन 24,866 15,999
रीजनिंग टोकन 0 598,430
प्रतिक्रिया समय (औसत) 7.60s 111.94s
प्रतिक्रिया समय (अधिकतम) 47.72s 1026.43s
प्रतिक्रिया समय (कुल) 167.28s 2462.67s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#59 Claude Opus 5

none
लागत
$0.271
समय
149.3s
टोकन
10,962 tok

#66 Qwen3.5-27B

medium
लागत
$0.008
समय
62.0s
टोकन
3,099 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Opus 5 5.9 9.7 33.3% 0 5.54s 10,590 2,886 0
Qwen3.5-27B 6.2 7.1 55.6% 1 160.69s 7,895 6,381 89,388

त्वरित तुलना

तुलना जोड़ी बदलें