नेविगेशन
Advertise here

Qwen3.7 Plus vs Grok 4.6 (medium)

average score लगभग बराबर है: 7.8 vs 7.8. Qwen3.7 Plus की benchmark लागत कम है: $0.184 vs $2.270. Qwen3.7 Plus तेज है: 17.80s vs 74.77s, pass rates 56.5% vs 78.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#108
कुल आउटपुट टोकन
76,261
प्रतिक्रिया समय (औसत)
17.80s
कुल लागत
$0.184
रैंक
#107
कुल आउटपुट टोकन
266,197
प्रतिक्रिया समय (औसत)
74.77s
कुल लागत
$2.270
अनुशंसित मॉडल Qwen3.7 Plus

It has the best score here (7.8), while costing about 12.4x less than Grok 4.6 (medium).

विस्तृत तुलना

मेट्रिक Qwen3.7 Plus Qwen3.7 Plus none रिलीज़: 2026-06-03 Grok 4.6 Grok 4.6 medium रिलीज़: 2026-08-12
स्कोर 7.8 7.8
रैंक #108 #107
विश्वसनीयता 10.0 10.0
संगति 10.0 8.7
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 56.5% 78.3%
अस्थिर टेस्ट 0 4
कुल रन 69 69
प्रति परिणाम लागत 1.410 14.187
कुल लागत $0.184 $2.270
इनपुट कीमत $0.320 / 1M $2.000 / 1M
आउटपुट कीमत $1.280 / 1M $6.000 / 1M
कुल इनपुट टोकन 250,495 336,351
आउटपुट टोकन 76,261 6,180
रीजनिंग टोकन 0 260,017
प्रतिक्रिया समय (औसत) 17.80s 74.77s
प्रतिक्रिया समय (अधिकतम) 206.03s 514.35s
प्रतिक्रिया समय (कुल) 409.51s 1719.73s
पैरामीटर ~397B कुल (~17B सक्रिय) ~1.7T कुल (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#108 Qwen3.7 Plus

none
लागत
$0.019
समय
213.5s
टोकन
11,960 tok

#107 SpaceXAI: Grok 4.6

medium
लागत
$0.028
समय
72.1s
टोकन
4,771 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.7 Plus 5.5 10.0 33.3% 0 2.15s 7,911 639 0
Grok 4.6 8.2 7.2 88.9% 1 120.05s 9,579 351 64,226

त्वरित तुलना

तुलना जोड़ी बदलें