नेविगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Qwen3.7 Plus vs Grok 4.5 (low)

average score लगभग बराबर है: 7.8 vs 7.8. Qwen3.7 Plus की benchmark लागत कम है: $0.184 vs $1.345. Qwen3.7 Plus तेज है: 17.80s vs 18.14s, pass rates 56.5% vs 73.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#108
कुल आउटपुट टोकन
76,261
प्रतिक्रिया समय (औसत)
17.80s
कुल लागत
$0.184
रैंक
#109
कुल आउटपुट टोकन
121,415
प्रतिक्रिया समय (औसत)
18.14s
कुल लागत
$1.345
अनुशंसित मॉडल Qwen3.7 Plus

It has the best score here (7.8), while costing about 7.3x less than Grok 4.5 (low).

विस्तृत तुलना

मेट्रिक Qwen3.7 Plus Qwen3.7 Plus none रिलीज़: 2026-06-03 Grok 4.5 Grok 4.5 low रिलीज़: 2026-07-08
स्कोर 7.8 7.8
रैंक #108 #109
विश्वसनीयता 10.0 10.0
संगति 10.0 9.3
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 56.5% 73.9%
अस्थिर टेस्ट 0 2
कुल रन 69 69
प्रति परिणाम लागत 1.410 8.404
कुल लागत $0.184 $1.345
इनपुट कीमत $0.320 / 1M $2.000 / 1M
आउटपुट कीमत $1.280 / 1M $6.000 / 1M
कुल इनपुट टोकन 250,495 308,068
आउटपुट टोकन 76,261 9,218
रीजनिंग टोकन 0 112,197
प्रतिक्रिया समय (औसत) 17.80s 18.14s
प्रतिक्रिया समय (अधिकतम) 206.03s 205.28s
प्रतिक्रिया समय (कुल) 409.51s 417.21s
पैरामीटर ~397B कुल (~17B सक्रिय) ~1.7T कुल (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#108 Qwen3.7 Plus

none
लागत
$0.019
समय
213.5s
टोकन
11,960 tok

#109 SpaceXAI: Grok 4.5

low
लागत
$0.011
समय
12.4s
टोकन
2,018 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.7 Plus 5.5 10.0 33.3% 0 2.15s 7,911 639 0
Grok 4.5 10.0 10.0 100.0% 0 13.72s 9,579 303 15,641

त्वरित तुलना

तुलना जोड़ी बदलें