नेविगेशन
AI BENCHY
Advertise here

Claude Sonnet 4.6 vs GLM 5.1 (medium)

Claude Sonnet 4.6 average score में आगे है: 7.3 vs 7.1. GLM 5.1 (medium) की benchmark लागत कम है: $0.535 vs $0.661. Claude Sonnet 4.6 तेज है: 8.12s vs 46.77s, pass rates 57.6% vs 69.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

रैंक
#71
कुल आउटपुट टोकन
19,362
प्रतिक्रिया समय (औसत)
8.12s
कुल लागत
$0.661
रैंक
#82
कुल आउटपुट टोकन
152,552
प्रतिक्रिया समय (औसत)
46.77s
कुल लागत
$0.535
अनुशंसित मॉडल Claude Sonnet 4.6

It has the best score here (7.3), while responding about 5.8x faster than GLM 5.1 (medium).

विस्तृत तुलना

मेट्रिक Claude Sonnet 4.6 Claude Sonnet 4.6 none रिलीज़: 2026-02-17 GLM 5.1 GLM 5.1 medium रिलीज़: 2026-04-07
स्कोर 7.3 7.1
रैंक #71 #82
विश्वसनीयता 10.0 8.3
संगति 9.7 8.4
सही परीक्षण
प्रति प्रयास पास दर 57.6% 69.7%
अस्थिर टेस्ट 1 4
कुल रन 66 66
प्रति परिणाम लागत 5.502 4.202
कुल लागत $0.661 $0.535
इनपुट कीमत $3.000 / 1M $0.966 / 1M
आउटपुट कीमत $15.000 / 1M $3.036 / 1M
कुल इनपुट टोकन 123,264 82,623
आउटपुट टोकन 19,362 16,089
रीजनिंग टोकन 0 136,463
प्रतिक्रिया समय (औसत) 8.12s 46.77s
प्रतिक्रिया समय (अधिकतम) 51.18s 308.75s
प्रतिक्रिया समय (कुल) 121.78s 982.16s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#71 Claude Sonnet 4.6

none
लागत
$0.038
समय
27.3s
टोकन
2,598 tok

#82 GLM 5.1

medium
अमान्य SVG
लागत
$0.000
समय
300.0s
टोकन
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 5.5 10.0 33.3% 0 5.19s 8,522 2,127 0
GLM 5.1 4.6 3.7 44.5% 2 109.63s 5,702 4,871 37,826

त्वरित तुलना

तुलना जोड़ी बदलें