नेविगेशन
Advertise here

Qwen3.7 Max vs Grok 4.7 (high)

average score लगभग बराबर है: 7.4 vs 7.5. Qwen3.7 Max की benchmark लागत कम है: $0.197 vs $2.180. Qwen3.7 Max तेज है: 4.56s vs 113.10s, pass rates 68.2% vs 75.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-21

तुलना किए गए मॉडल

रैंक
#120
कुल आउटपुट टोकन
12,446
प्रतिक्रिया समय (औसत)
4.56s
कुल लागत
$0.197
रैंक
#110
कुल आउटपुट टोकन
416,086
प्रतिक्रिया समय (औसत)
113.10s
कुल लागत
$2.180
अनुशंसित मॉडल Qwen3.7 Max

It has the best score here (7.4), while costing about 11.1x less than Grok 4.7 (high).

विस्तृत तुलना

मेट्रिक Qwen3.7 Max Qwen3.7 Max none रिलीज़: 2026-05-22 Grok 4.7 Grok 4.7 high रिलीज़: 2026-09-21
स्कोर 7.4 7.5
रैंक #120 #110
विश्वसनीयता 9.9 9.5
संगति 10.0 7.6
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 68.2% 75.8%
अस्थिर टेस्ट 0 7
कुल रन 66 66
प्रति परिणाम लागत 1.581 16.765
कुल लागत $0.197 $2.180
इनपुट कीमत $1.475 / 1M $1.600 / 1M
आउटपुट कीमत $4.425 / 1M $4.800 / 1M
कुल इनपुट टोकन 95,992 113,892
आउटपुट टोकन 12,446 6,907
रीजनिंग टोकन 0 409,179
प्रतिक्रिया समय (औसत) 4.56s 113.10s
प्रतिक्रिया समय (अधिकतम) 72.30s 573.57s
प्रतिक्रिया समय (कुल) 100.30s 2488.20s
पैरामीटर ~1T कुल (~40B सक्रिय) ~1.7T कुल (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#120 Qwen3.7 Max

none
लागत
$0.046
समय
195.0s
टोकन
12,171 tok

#110 SpaceXAI: Grok 4.7

high
लागत
$0.110
समय
301.3s
टोकन
23,143 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.7 Max 5.5 10.0 33.3% 0 1.35s 7,911 582 0
Grok 4.7 6.0 4.6 66.7% 2 335.92s 10,266 353 199,976

त्वरित तुलना

तुलना जोड़ी बदलें