नेविगेशन
AI BENCHY
Advertise here

Qwen3.7 Max (medium) vs Grok 4.6 (high)

Grok 4.6 (high) average score में आगे है: 9.2 vs 9.2. Qwen3.7 Max (medium) की benchmark लागत कम है: $1.116 vs $1.809. Qwen3.7 Max (medium) तेज है: 40.57s vs 79.38s, pass rates 87.9% vs 84.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-12

रैंक
#13
कुल आउटपुट टोकन
216,752
प्रतिक्रिया समय (औसत)
40.57s
कुल लागत
$1.116
रैंक
#11
कुल आउटपुट टोकन
265,604
प्रतिक्रिया समय (औसत)
79.38s
कुल लागत
$1.809
अनुशंसित मॉडल Qwen3.7 Max (medium)

Its score stays close to the best score here (9.2 vs 9.2), while costing about 1.6x less than Grok 4.6 (high).

विस्तृत तुलना

मेट्रिक Qwen3.7 Max Qwen3.7 Max medium रिलीज़: 2026-05-22 Grok 4.6 Grok 4.6 high रिलीज़: 2026-08-12
स्कोर 9.2 9.2
रैंक #13 #11
विश्वसनीयता 10.0 10.0
संगति 9.3 9.6
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 87.9% 84.9%
अस्थिर टेस्ट 2 1
कुल रन 66 66
प्रति परिणाम लागत 8.292 10.046
कुल लागत $1.116 $1.809
इनपुट कीमत $1.475 / 1M $2.000 / 1M
आउटपुट कीमत $4.425 / 1M $6.000 / 1M
कुल इनपुट टोकन 106,020 107,266
आउटपुट टोकन 5,748 5,094
रीजनिंग टोकन 211,004 260,510
प्रतिक्रिया समय (औसत) 40.57s 79.38s
प्रतिक्रिया समय (अधिकतम) 556.06s 618.49s
प्रतिक्रिया समय (कुल) 892.57s 1746.29s
पैरामीटर ~1T कुल (~40B सक्रिय) ~1.7T कुल (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#13 Qwen3.7 Max

medium
लागत
$0.017
समय
68.8s
टोकन
4,526 tok

#11 SpaceXAI: Grok 4.6

high
लागत
$0.107
समय
265.1s
टोकन
18,001 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.7 Max 10.0 10.0 100.0% 0 35.31s 7,893 423 34,808
Grok 4.6 10.0 10.0 100.0% 0 102.20s 9,579 379 51,829

त्वरित तुलना

तुलना जोड़ी बदलें