नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Qwen: Qwen3.7 Max vs xAI: Grok 4.5

Qwen3.7 Max (medium) average score में आगे है: 9.2 vs 8.4. Grok 4.5 (low) की benchmark लागत कम है: $0.935 vs $1.116. Grok 4.5 (low) तेज है: 15.56s vs 40.57s, pass rates 87.9% vs 75.8%.

अनुशंसित मॉडलQwen3.7 Max (medium)It has the strongest score in this comparison (9.2) and the best overall balance of cost and response time across all 2 models.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-21

मेट्रिक Qwen3.7 Max Qwen3.7 Max medium रिलीज़: 2026-05-22 Grok 4.5 Grok 4.5 low रिलीज़: 2026-07-08
स्कोर 9.2 8.4
रैंक #11 #23
विश्वसनीयता 10.0 10.0
संगति 9.3 9.7
सही परीक्षण
प्रति प्रयास पास दर 87.9% 75.8%
अस्थिर टेस्ट 2 1
कुल रन 66 66
प्रति परिणाम लागत 8.292 5.844
कुल लागत $1.116 $0.935
इनपुट कीमत $1.475 / 1M $2.000 / 1M
आउटपुट कीमत $4.425 / 1M $6.000 / 1M
कुल इनपुट टोकन 106,020 125,596
आउटपुट टोकन 5,748 7,505
रीजनिंग टोकन 211,004 106,446
प्रतिक्रिया समय (औसत) 40.57s 15.56s
प्रतिक्रिया समय (अधिकतम) 556.06s 205.28s
प्रतिक्रिया समय (कुल) 892.57s 342.32s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#11 Qwen3.7 Max

medium
लागत
$0.017
समय
68.8s
टोकन
4,526 tok

#23 xAI: Grok 4.5

low
लागत
$0.011
समय
12.4s
टोकन
2,018 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.7 Max 10.0 10.0 100.0% 0 35.31s 7,893 423 34,808
Grok 4.5 10.0 10.0 100.0% 0 13.72s 9,579 303 15,641

त्वरित तुलना

तुलना जोड़ी बदलें