नेविगेशन
Advertise here

Qwen3.7 Plus vs Grok 4.5 (medium)

average score लगभग बराबर है: 7.8 vs 7.8. Qwen3.7 Plus की benchmark लागत कम है: $0.184 vs $2.454. Qwen3.7 Plus तेज है: 17.80s vs 68.44s, pass rates 56.5% vs 79.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#108
कुल आउटपुट टोकन
76,261
प्रतिक्रिया समय (औसत)
17.80s
कुल लागत
$0.184
रैंक
#104
कुल आउटपुट टोकन
306,044
प्रतिक्रिया समय (औसत)
68.44s
कुल लागत
$2.454
अनुशंसित मॉडल Qwen3.7 Plus

It has the best score here (7.8), while costing about 13.4x less than Grok 4.5 (medium).

विस्तृत तुलना

मेट्रिक Qwen3.7 Plus Qwen3.7 Plus none रिलीज़: 2026-06-03 Grok 4.5 Grok 4.5 medium रिलीज़: 2026-07-08
स्कोर 7.8 7.8
रैंक #108 #104
विश्वसनीयता 10.0 10.0
संगति 10.0 9.0
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 56.5% 79.7%
अस्थिर टेस्ट 0 3
कुल रन 69 69
प्रति परिणाम लागत 1.410 14.430
कुल लागत $0.184 $2.454
इनपुट कीमत $0.320 / 1M $2.000 / 1M
आउटपुट कीमत $1.280 / 1M $6.000 / 1M
कुल इनपुट टोकन 250,495 308,369
आउटपुट टोकन 76,261 7,013
रीजनिंग टोकन 0 299,031
प्रतिक्रिया समय (औसत) 17.80s 68.44s
प्रतिक्रिया समय (अधिकतम) 206.03s 436.38s
प्रतिक्रिया समय (कुल) 409.51s 1574.14s
पैरामीटर ~397B कुल (~17B सक्रिय) ~1.7T कुल (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#108 Qwen3.7 Plus

none
लागत
$0.019
समय
213.5s
टोकन
11,960 tok

#104 SpaceXAI: Grok 4.5

medium
लागत
$0.044
समय
59.4s
टोकन
7,512 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.7 Plus 5.5 10.0 33.3% 0 2.15s 7,911 639 0
Grok 4.5 7.6 7.2 77.8% 1 155.69s 9,579 390 104,634

त्वरित तुलना

तुलना जोड़ी बदलें