नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Anthropic: Claude Sonnet 4.6 vs Qwen: Qwen3.7 Max

Qwen3.7 Max average score में आगे है: 7.4 vs 7.3. Qwen3.7 Max की benchmark लागत कम है: $0.197 vs $0.661. Qwen3.7 Max तेज है: 4.52s vs 8.12s, pass rates 57.6% vs 68.2%.

अनुशंसित मॉडलQwen3.7 MaxIt has the best score here (7.4), while costing about 3.4x less than Claude Sonnet 4.6.
रैंक
#71
प्रति प्रयास पास दर
57.6%
कुल आउटपुट टोकन
19,362
प्रतिक्रिया समय (औसत)
8.12s
कुल लागत
$0.661
रैंक
#67
प्रति प्रयास पास दर
68.2%
कुल आउटपुट टोकन
12,446
प्रतिक्रिया समय (औसत)
4.52s
कुल लागत
$0.197

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

मेट्रिक Claude Sonnet 4.6 Claude Sonnet 4.6 none रिलीज़: 2026-02-17 Qwen3.7 Max Qwen3.7 Max none रिलीज़: 2026-05-22
स्कोर 7.3 7.4
रैंक #71 #67
विश्वसनीयता 10.0 9.9
संगति 9.7 10.0
सही परीक्षण
प्रति प्रयास पास दर 57.6% 68.2%
अस्थिर टेस्ट 1 0
कुल रन 66 66
प्रति परिणाम लागत 5.502 1.582
कुल लागत $0.661 $0.197
इनपुट कीमत $3.000 / 1M $1.475 / 1M
आउटपुट कीमत $15.000 / 1M $4.425 / 1M
कुल इनपुट टोकन 123,264 95,983
आउटपुट टोकन 19,362 12,446
रीजनिंग टोकन 0 0
प्रतिक्रिया समय (औसत) 8.12s 4.52s
प्रतिक्रिया समय (अधिकतम) 51.18s 72.30s
प्रतिक्रिया समय (कुल) 121.78s 99.52s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#71 Claude Sonnet 4.6

none
लागत
$0.038
समय
27.3s
टोकन
2,598 tok

#67 Qwen3.7 Max

none
लागत
$0.046
समय
195.0s
टोकन
12,171 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 5.5 10.0 33.3% 0 5.19s 8,522 2,127 0
Qwen3.7 Max 5.5 10.0 33.3% 0 1.35s 7,911 582 0

त्वरित तुलना

तुलना जोड़ी बदलें