नेविगेशन
Advertise here

Qwen3.7 Max vs Grok 4.6 (low)

Qwen3.7 Max average score में आगे है: 7.4 vs 7.4. Qwen3.7 Max की benchmark लागत कम है: $0.197 vs $0.449. Qwen3.7 Max तेज है: 4.56s vs 14.55s, pass rates 68.2% vs 69.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-24

तुलना किए गए मॉडल

रैंक
#129
कुल आउटपुट टोकन
12,446
प्रतिक्रिया समय (औसत)
4.56s
कुल लागत
$0.197
रैंक
#135
कुल आउटपुट टोकन
38,048
प्रतिक्रिया समय (औसत)
14.55s
कुल लागत
$0.449
अनुशंसित मॉडल Qwen3.7 Max

It has the best score here (7.4), while costing about 2.3x less than Grok 4.6 (low).

विस्तृत तुलना

मेट्रिक Qwen3.7 Max Qwen3.7 Max none रिलीज़: 2026-05-22 Grok 4.6 Grok 4.6 low रिलीज़: 2026-08-12
स्कोर 7.4 7.4
रैंक #129 #135
विश्वसनीयता 9.9 10.0
संगति 10.0 9.6
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 68.2% 69.7%
अस्थिर टेस्ट 0 1
कुल रन 66 66
प्रति परिणाम लागत 1.581 2.989
कुल लागत $0.197 $0.449
इनपुट कीमत $1.475 / 1M $2.000 / 1M
आउटपुट कीमत $4.425 / 1M $6.000 / 1M
कुल इनपुट टोकन 95,992 109,960
आउटपुट टोकन 12,446 5,124
रीजनिंग टोकन 0 32,924
प्रतिक्रिया समय (औसत) 4.56s 14.55s
प्रतिक्रिया समय (अधिकतम) 72.30s 26.46s
प्रतिक्रिया समय (कुल) 100.30s 320.17s
पैरामीटर ~1T कुल (~40B सक्रिय) ~1.7T कुल (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#129 Qwen3.7 Max

none
लागत
$0.046
समय
195.0s
टोकन
12,171 tok

#135 SpaceXAI: Grok 4.6

low
लागत
$0.011
समय
26.0s
टोकन
1,941 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.7 Max 5.5 10.0 33.3% 0 1.35s 7,911 582 0
Grok 4.6 5.5 7.1 44.4% 1 21.69s 9,579 349 7,740

त्वरित तुलना

तुलना जोड़ी बदलें