नेविगेशन
AI BENCHY
Advertise here

Claude Opus 5 vs Qwen: Qwen3.7 Max

Claude Opus 5 (high) average score में आगे है: 9.2 vs 9.2. Qwen3.7 Max (medium) की benchmark लागत कम है: $1.116 vs $2.835. Claude Opus 5 (high) तेज है: 20.44s vs 40.57s, pass rates 84.9% vs 87.9%.

अनुशंसित मॉडलQwen3.7 Max (medium)Its score stays close to the best score here (9.2 vs 9.2), while costing about 2.5x less than Claude Opus 5 (high).

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

मेट्रिक Claude Opus 5 Claude Opus 5 high रिलीज़: 2026-07-25 Qwen3.7 Max Qwen3.7 Max medium रिलीज़: 2026-05-22
स्कोर 9.2 9.2
रैंक #11 #13
विश्वसनीयता 10.0 10.0
संगति 9.6 9.3
सही परीक्षण
प्रति प्रयास पास दर 84.9% 87.9%
अस्थिर टेस्ट 1 2
कुल रन 66 66
प्रति परिणाम लागत 15.747 8.292
कुल लागत $2.835 $1.116
इनपुट कीमत $5.000 / 1M $1.475 / 1M
आउटपुट कीमत $25.000 / 1M $4.425 / 1M
कुल इनपुट टोकन 135,959 106,020
आउटपुट टोकन 67,066 5,748
रीजनिंग टोकन 19,114 211,004
प्रतिक्रिया समय (औसत) 20.44s 40.57s
प्रतिक्रिया समय (अधिकतम) 159.01s 556.06s
प्रतिक्रिया समय (कुल) 449.68s 892.57s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#11 Claude Opus 5

high
लागत
$0.265
समय
144.5s
टोकन
10,741 tok

#13 Qwen3.7 Max

medium
लागत
$0.017
समय
68.8s
टोकन
4,526 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Opus 5 10.0 10.0 100.0% 0 12.73s 10,590 7,547 1,721
Qwen3.7 Max 10.0 10.0 100.0% 0 35.31s 7,893 423 34,808

त्वरित तुलना

तुलना जोड़ी बदलें