नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Qwen3.7 Max vs Grok 4.6 (low)

Qwen3.7 Max average score में आगे है: 7.4 vs 7.4. Qwen3.7 Max की benchmark लागत कम है: $0.197 vs $0.441. Qwen3.7 Max तेज है: 4.52s vs 14.20s, pass rates 68.2% vs 71.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-12

रैंक
#87
कुल आउटपुट टोकन
12,446
प्रतिक्रिया समय (औसत)
4.52s
कुल लागत
$0.197
रैंक
#90
कुल आउटपुट टोकन
36,792
प्रतिक्रिया समय (औसत)
14.20s
कुल लागत
$0.441
अनुशंसित मॉडल Qwen3.7 Max

It has the best score here (7.4), while costing about 2.2x less than Grok 4.6 (low).

विस्तृत तुलना

मेट्रिक Qwen3.7 Max Qwen3.7 Max none रिलीज़: 2026-05-22 Grok 4.6 Grok 4.6 low रिलीज़: 2026-08-12
स्कोर 7.4 7.4
रैंक #87 #90
विश्वसनीयता 9.9 10.0
संगति 10.0 9.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 68.2% 71.2%
अस्थिर टेस्ट 0 2
कुल रन 66 66
प्रति परिणाम लागत 1.582 2.938
कुल लागत $0.197 $0.441
इनपुट कीमत $1.475 / 1M $2.000 / 1M
आउटपुट कीमत $4.425 / 1M $6.000 / 1M
कुल इनपुट टोकन 95,983 109,951
आउटपुट टोकन 12,446 5,124
रीजनिंग टोकन 0 31,668
प्रतिक्रिया समय (औसत) 4.52s 14.20s
प्रतिक्रिया समय (अधिकतम) 72.30s 26.46s
प्रतिक्रिया समय (कुल) 99.52s 312.33s
पैरामीटर ~1T कुल (~40B सक्रिय) ~1.7T कुल (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#87 Qwen3.7 Max

none
लागत
$0.046
समय
195.0s
टोकन
12,171 tok

#90 SpaceXAI: Grok 4.6

low
लागत
$0.011
समय
26.0s
टोकन
1,941 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.7 Max 5.5 10.0 33.3% 0 1.35s 7,911 582 0
Grok 4.6 5.5 7.1 44.4% 1 21.69s 9,579 349 7,740

त्वरित तुलना

तुलना जोड़ी बदलें