नेविगेशन
AI BENCHY
Advertise here

Qwen: Qwen3.6 Max Preview vs xAI: Grok 4.5

Qwen3.6 Max Preview (medium) average score में आगे है: 8.4 vs 8.3. Qwen3.6 Max Preview (medium) की benchmark लागत कम है: $1.143 vs $1.928. Grok 4.5 (medium) तेज है: 61.71s vs 67.53s, pass rates 80.3% vs 78.8%.

अनुशंसित मॉडलQwen3.6 Max Preview (medium)It has the best score here (8.4), while costing about 1.7x less than Grok 4.5 (medium).

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

मेट्रिक Qwen3.6 Max Preview Qwen3.6 Max Preview medium रिलीज़: 2026-04-20 Grok 4.5 Grok 4.5 medium रिलीज़: 2026-07-08
स्कोर 8.4 8.3
रैंक #25 #28
विश्वसनीयता 9.9 10.0
संगति 8.9 8.9
सही परीक्षण
प्रति प्रयास पास दर 80.3% 78.8%
अस्थिर टेस्ट 3 3
कुल रन 66 66
प्रति परिणाम लागत 8.173 12.049
कुल लागत $1.143 $1.928
इनपुट कीमत $1.040 / 1M $2.000 / 1M
आउटपुट कीमत $6.240 / 1M $6.000 / 1M
कुल इनपुट टोकन 79,240 122,146
आउटपुट टोकन 5,098 5,514
रीजनिंग टोकन 164,842 275,053
प्रतिक्रिया समय (औसत) 67.53s 61.71s
प्रतिक्रिया समय (अधिकतम) 238.07s 436.38s
प्रतिक्रिया समय (कुल) 1485.64s 1357.56s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#25 Qwen3.6 Max Preview

medium
लागत
$0.024
समय
76.5s
टोकन
3,861 tok

#28 xAI: Grok 4.5

medium
लागत
$0.044
समय
59.4s
टोकन
7,512 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.6 Max Preview 8.8 7.8 88.9% 1 146.48s 7,895 427 52,957
Grok 4.5 7.6 7.2 77.8% 1 155.69s 9,579 390 104,634

त्वरित तुलना

तुलना जोड़ी बदलें