नेविगेशन
AI BENCHY
Advertise here

Claude Sonnet 4.6 vs Qwen3.5-27B (medium)

Qwen3.5-27B (medium) average score में आगे है: 7.4 vs 7.3. Claude Sonnet 4.6 की benchmark लागत कम है: $0.661 vs $0.981. Claude Sonnet 4.6 तेज है: 8.12s vs 111.94s, pass rates 57.6% vs 72.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-12

रैंक
#92
कुल आउटपुट टोकन
19,362
प्रतिक्रिया समय (औसत)
8.12s
कुल लागत
$0.661
रैंक
#86
कुल आउटपुट टोकन
614,429
प्रतिक्रिया समय (औसत)
111.94s
कुल लागत
$0.981
अनुशंसित मॉडल Claude Sonnet 4.6

Its score stays close to the best score here (7.3 vs 7.4), while responding about 13.8x faster than Qwen3.5-27B (medium).

विस्तृत तुलना

मेट्रिक Claude Sonnet 4.6 Claude Sonnet 4.6 none रिलीज़: 2026-02-17 Qwen3.5-27B Qwen3.5-27B medium रिलीज़: 2026-02-24
स्कोर 7.3 7.4
रैंक #92 #86
विश्वसनीयता 10.0 10.0
संगति 9.7 8.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 57.6% 72.7%
अस्थिर टेस्ट 1 5
कुल रन 66 66
प्रति परिणाम लागत 5.502 8.324
कुल लागत $0.661 $0.981
इनपुट कीमत $3.000 / 1M $0.195 / 1M
आउटपुट कीमत $15.000 / 1M $1.560 / 1M
कुल इनपुट टोकन 123,264 111,635
आउटपुट टोकन 19,362 15,999
रीजनिंग टोकन 0 598,430
प्रतिक्रिया समय (औसत) 8.12s 111.94s
प्रतिक्रिया समय (अधिकतम) 51.18s 1026.43s
प्रतिक्रिया समय (कुल) 121.78s 2462.67s
पैरामीटर ~1T कुल (~100B सक्रिय) 27B
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#92 Claude Sonnet 4.6

none
लागत
$0.038
समय
27.3s
टोकन
2,598 tok

#86 Qwen3.5-27B

medium
लागत
$0.008
समय
62.0s
टोकन
3,099 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 5.5 10.0 33.3% 0 5.19s 8,522 2,127 0
Qwen3.5-27B 6.2 7.1 55.6% 1 160.69s 7,895 6,381 89,388

त्वरित तुलना

तुलना जोड़ी बदलें