नेविगेशन
AI BENCHY
Advertise here

Claude Sonnet 4.6 vs Qwen3.5-35B-A3B (medium)

Claude Sonnet 4.6 average score में आगे है: 7.3 vs 6.2. Claude Sonnet 4.6 की benchmark लागत कम है: $0.661 vs $0.837. Claude Sonnet 4.6 तेज है: 8.12s vs 112.47s, pass rates 57.6% vs 66.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

रैंक
#71
कुल आउटपुट टोकन
19,362
प्रतिक्रिया समय (औसत)
8.12s
कुल लागत
$0.661
रैंक
#130
कुल आउटपुट टोकन
826,670
प्रतिक्रिया समय (औसत)
112.47s
कुल लागत
$0.837
अनुशंसित मॉडल Claude Sonnet 4.6

It has the best score here (7.3), while responding about 13.9x faster than Qwen3.5-35B-A3B (medium).

विस्तृत तुलना

मेट्रिक Claude Sonnet 4.6 Claude Sonnet 4.6 none रिलीज़: 2026-02-17 Qwen3.5-35B-A3B Qwen3.5-35B-A3B medium रिलीज़: 2026-02-24
स्कोर 7.3 6.2
रैंक #71 #130
विश्वसनीयता 10.0 10.0
संगति 9.7 7.6
सही परीक्षण
प्रति प्रयास पास दर 57.6% 66.7%
अस्थिर टेस्ट 1 6
कुल रन 66 66
प्रति परिणाम लागत 5.502 9.130
कुल लागत $0.661 $0.837
इनपुट कीमत $3.000 / 1M $0.140 / 1M
आउटपुट कीमत $15.000 / 1M $1.000 / 1M
कुल इनपुट टोकन 123,264 130,388
आउटपुट टोकन 19,362 40,630
रीजनिंग टोकन 0 786,040
प्रतिक्रिया समय (औसत) 8.12s 112.47s
प्रतिक्रिया समय (अधिकतम) 51.18s 950.25s
प्रतिक्रिया समय (कुल) 121.78s 2474.28s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#71 Claude Sonnet 4.6

none
लागत
$0.038
समय
27.3s
टोकन
2,598 tok

#130 Qwen3.5-35B-A3B

medium
लागत
$0.009
समय
71.4s
टोकन
8,631 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 5.5 10.0 33.3% 0 5.19s 8,522 2,127 0
Qwen3.5-35B-A3B 5.9 9.3 33.3% 0 206.65s 4,106 23,844 111,462

त्वरित तुलना

तुलना जोड़ी बदलें