नेविगेशन
AI BENCHY
Advertise here

Qwen3.5-27B (medium) vs Grok 4.6 (low)

Qwen3.5-27B (medium) average score में आगे है: 7.4 vs 7.4. Grok 4.6 (low) की benchmark लागत कम है: $0.441 vs $0.981. Grok 4.6 (low) तेज है: 14.20s vs 111.94s, pass rates 72.7% vs 71.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-12

रैंक
#86
कुल आउटपुट टोकन
614,429
प्रतिक्रिया समय (औसत)
111.94s
कुल लागत
$0.981
रैंक
#90
कुल आउटपुट टोकन
36,792
प्रतिक्रिया समय (औसत)
14.20s
कुल लागत
$0.441
अनुशंसित मॉडल Grok 4.6 (low)

Its score stays close to the best score here (7.4 vs 7.4), while costing about 2.2x less than Qwen3.5-27B (medium).

विस्तृत तुलना

मेट्रिक Qwen3.5-27B Qwen3.5-27B medium रिलीज़: 2026-02-24 Grok 4.6 Grok 4.6 low रिलीज़: 2026-08-12
स्कोर 7.4 7.4
रैंक #86 #90
विश्वसनीयता 10.0 10.0
संगति 8.2 9.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 72.7% 71.2%
अस्थिर टेस्ट 5 2
कुल रन 66 66
प्रति परिणाम लागत 8.324 2.938
कुल लागत $0.981 $0.441
इनपुट कीमत $0.195 / 1M $2.000 / 1M
आउटपुट कीमत $1.560 / 1M $6.000 / 1M
कुल इनपुट टोकन 111,635 109,951
आउटपुट टोकन 15,999 5,124
रीजनिंग टोकन 598,430 31,668
प्रतिक्रिया समय (औसत) 111.94s 14.20s
प्रतिक्रिया समय (अधिकतम) 1026.43s 26.46s
प्रतिक्रिया समय (कुल) 2462.67s 312.33s
पैरामीटर 27B ~1.7T कुल (~170B सक्रिय)
उपलब्धता मुक्त स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#86 Qwen3.5-27B

medium
लागत
$0.008
समय
62.0s
टोकन
3,099 tok

#90 SpaceXAI: Grok 4.6

low
लागत
$0.011
समय
26.0s
टोकन
1,941 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Qwen3.5-27B 6.2 7.1 55.6% 1 160.69s 7,895 6,381 89,388
Grok 4.6 5.5 7.1 44.4% 1 21.69s 9,579 349 7,740

त्वरित तुलना

तुलना जोड़ी बदलें