नेविगेशन
AI BENCHY
Advertise here

Anthropic: Claude Sonnet 4.6 vs Z.ai: GLM 5.2

Claude Sonnet 4.6 average score में आगे है: 7.3 vs 6.6. GLM 5.2 की benchmark लागत कम है: $0.125 vs $0.661. Claude Sonnet 4.6 तेज है: 8.12s vs 9.34s, pass rates 57.6% vs 59.1%.

अनुशंसित मॉडलGLM 5.2Its score stays close to the best score here (6.6 vs 7.3), while costing about 5.3x less than Claude Sonnet 4.6.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

मेट्रिक Claude Sonnet 4.6 Claude Sonnet 4.6 none रिलीज़: 2026-02-17 GLM 5.2 GLM 5.2 none रिलीज़: 2026-06-17
स्कोर 7.3 6.6
रैंक #71 #105
विश्वसनीयता 10.0 10.0
संगति 9.7 9.2
सही परीक्षण
प्रति प्रयास पास दर 57.6% 59.1%
अस्थिर टेस्ट 1 2
कुल रन 66 64
प्रति परिणाम लागत 5.502 1.421
कुल लागत $0.661 $0.125
इनपुट कीमत $3.000 / 1M $0.793 / 1M
आउटपुट कीमत $15.000 / 1M $2.491 / 1M
कुल इनपुट टोकन 123,264 112,359
आउटपुट टोकन 19,362 14,340
रीजनिंग टोकन 0 0
प्रतिक्रिया समय (औसत) 8.12s 9.34s
प्रतिक्रिया समय (अधिकतम) 51.18s 79.65s
प्रतिक्रिया समय (कुल) 121.78s 205.46s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#71 Claude Sonnet 4.6

none
लागत
$0.038
समय
27.3s
टोकन
2,598 tok

#105 GLM 5.2

none
अमान्य SVG
लागत
$0.033
समय
87.7s
टोकन
7,455 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 5.5 10.0 33.3% 0 5.19s 8,522 2,127 0
GLM 5.2 3.7 9.5 0.0% 0 7.55s 7,263 1,958 0

त्वरित तुलना

तुलना जोड़ी बदलें