नेविगेशन
AI BENCHY
Advertise here

Qwen3.7 Max (medium) vs Grok 4.5 (high)

Qwen3.7 Max (medium) average score में आगे है: 9.1 vs 9.0. Qwen3.7 Max (medium) की benchmark लागत कम है: $1.157 vs $2.252. Qwen3.7 Max (medium) तेज है: 44.32s vs 72.30s, pass rates 86.4% vs 86.4%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-29

रैंक
#17
कुल आउटपुट टोकन
226,102
प्रतिक्रिया समय (औसत)
44.32s
कुल लागत
$1.157
रैंक
#21
कुल आउटपुट टोकन
324,462
प्रतिक्रिया समय (औसत)
72.30s
कुल लागत
$2.252
अनुशंसित मॉडल Qwen3.7 Max (medium)

It has the best score here (9.1), while costing about 1.9x less than Grok 4.5 (high).

विस्तृत तुलना

मेट्रिक Qwen3.7 Max Qwen3.7 Max medium रिलीज़: 2026-05-22 Grok 4.5 Grok 4.5 high रिलीज़: 2026-07-08
स्कोर 9.1 9.0
रैंक #17 #21
विश्वसनीयता 10.0 10.0
संगति 9.0 8.9
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 86.4% 86.4%
अस्थिर टेस्ट 3 3
कुल रन 66 66
प्रति परिणाम लागत 8.904 12.565
कुल लागत $1.157 $2.252
इनपुट कीमत $1.475 / 1M $2.000 / 1M
आउटपुट कीमत $4.425 / 1M $6.000 / 1M
कुल इनपुट टोकन 106,029 152,175
आउटपुट टोकन 5,748 5,655
रीजनिंग टोकन 220,354 318,807
प्रतिक्रिया समय (औसत) 44.32s 72.30s
प्रतिक्रिया समय (अधिकतम) 556.06s 676.83s
प्रतिक्रिया समय (कुल) 975.11s 1590.56s
पैरामीटर ~1T कुल (~40B सक्रिय) ~1.7T कुल (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#17 Qwen3.7 Max

medium
लागत
$0.017
समय
68.8s
टोकन
4,526 tok

#21 SpaceXAI: Grok 4.5

high
लागत
$0.015
समय
29.7s
टोकन
2,737 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.7 Max 10.0 10.0 100.0% 0 35.31s 7,893 423 34,808
Grok 4.5 10.0 10.0 100.0% 0 155.16s 9,579 357 100,752

त्वरित तुलना

तुलना जोड़ी बदलें