AI BENCHY तुलना

Anthropic: Claude Sonnet 4.6 vs Qwen: Qwen3.7 Plus

सारांश

Claude Sonnet 4.6 vs Qwen3.7 Plus benchmark तुलना: Claude Sonnet 4.6 average score में आगे है: 7.3 vs 7.2. Qwen3.7 Plus की benchmark लागत कम है: $0.023 vs $0.316. Qwen3.7 Plus तेज है: 2.85s vs 5.04s, pass rates 55.6% vs 47.6%.

अनुशंसित मॉडल: Qwen3.7 Plus - Its score stays close to the best score here (7.2 vs 7.3), while costing about 14.3x less than Claude Sonnet 4.6.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-06-12

मेट्रिक	Claude Sonnet 4.6 Claude Sonnet 4.6 none रिलीज़: 2026-02-17	Qwen3.7 Plus Qwen3.7 Plus none रिलीज़: 2026-06-03

मेट्रिक	Claude Sonnet 4.6 Claude Sonnet 4.6 none रिलीज़: 2026-02-17	Qwen3.7 Plus Qwen3.7 Plus none रिलीज़: 2026-06-03
स्कोर	7.3	7.2
रैंक	#56	#61
विश्वसनीयता	10.0	10.0
संगति	9.7	10.0
सही परीक्षण
प्रति प्रयास पास दर	55.6%	47.6%
अस्थिर टेस्ट	1	0
कुल रन	63	63
प्रति परिणाम लागत	2.870	0.276
कुल लागत	$0.316	$0.023
इनपुट कीमत	$3.000 / 1M	$0.320 / 1M
आउटपुट कीमत	$15.000 / 1M	$1.280 / 1M
कुल इनपुट टोकन	57,886	42,510
आउटपुट टोकन	9,465	6,578
रीजनिंग टोकन	0	0
प्रतिक्रिया समय (औसत)	5.04s	2.85s
प्रतिक्रिया समय (अधिकतम)	23.84s	29.38s
प्रतिक्रिया समय (कुल)	70.60s	59.86s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#56 Claude Sonnet 4.6

none

Cost: $0.038
Time: 27.3s
Tokens: 2,598 tok

#61 Qwen3.7 Plus

none

Cost: $0.019
Time: 213.5s
Tokens: 11,960 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
Claude Sonnet 4.6	4.8	10.0	25.0%	0		2.94s	636	1,214	0
Qwen3.7 Plus	6.5	10.0	50.0%	0		1.38s	696	349	0

कोडिंग	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
Claude Sonnet 4.6	5.5	10.0	33.3%	0		5.19s	8,522	2,127	0
Qwen3.7 Plus	5.5	10.0	33.3%	0		2.15s	7,911	639	0

संयुक्त	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
Claude Sonnet 4.6	9.5	10.0	100.0%	0		23.84s	26,024	3,766	0
Qwen3.7 Plus	10.0	10.0	100.0%	0		29.38s	14,952	4,505	0

डेटा पार्सिंग और निष्कर्षण	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
Claude Sonnet 4.6	10.0	10.0	100.0%	0		3.43s	8,574	252	0
Qwen3.7 Plus	10.0	10.0	100.0%	0		1.43s	7,794	243	0

डोमेन-विशिष्ट	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
Claude Sonnet 4.6	7.7	10.0	66.7%	0		3.54s	759	413	0
Qwen3.7 Plus	3.0	10.0	0.0%	0		868ms	789	18	0

Samanya Buddhimatta	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
Claude Sonnet 4.6	6.1	3.1	66.7%	1		2.56s	513	192	0
Qwen3.7 Plus	5.3	10.0	0.0%	0		1.33s	522	78	0

निर्देश पालन	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
Claude Sonnet 4.6	6.5	10.0	50.0%	0		1.96s	690	90	0
Qwen3.7 Plus	6.3	10.0	50.0%	0		929ms	711	72	0

पहेली समाधान	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
Claude Sonnet 4.6	7.7	10.0	66.7%	0		2.53s	663	533	0
Qwen3.7 Plus	7.7	10.0	66.7%	0		1.71s	714	443	0

टूल कॉलिंग	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
Claude Sonnet 4.6	10.0	10.0	100.0%	0		4.11s	11,301	447	0
Qwen3.7 Plus	10.0	10.0	100.0%	0		3.54s	8,211	222	0

सामान्य ज्ञान	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
Claude Sonnet 4.6	3.0	10.0	0.0%	0		4.67s	204	431	0
Qwen3.7 Plus	3.0	10.0	0.0%	0		1.21s	210	9	0

त्वरित तुलना

तुलना जोड़ी बदलें

Gemma 4 26B A4Bmediumनिःशुल्क उपलब्धvsQwen3.7 Plusnone Claude Sonnet 4.6nonevsGrok 4.20medium Claude Sonnet 4.6nonevsGLM 5V Turbomedium Claude Sonnet 4.6nonevsGemini 3 Flash Previewlow Qwen3.7 PlusnonevsMiMo-V2-Flashmedium Qwen3.7 PlusnonevsStep 3.7 Flashhigh Qwen3.7 PlusnonevsGLM 5.1medium Qwen3.7 PlusnonevsGLM 5V Turbomedium Claude Sonnet 4.6nonevsMiMo-V2.5-Promedium Claude Sonnet 4.6nonevsSeed-2.0-Minimedium Claude Sonnet 4.6nonevsGemma 4 26B A4Bmediumनिःशुल्क उपलब्ध Kimi K2.7 CodemediumvsQwen3.7 Plusnone