नेविगेशन
AI BENCHY
Your ad here

AI BENCHY तुलना

Qwen3.6 Plus Preview vs Grok 4.20 Beta

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-04-29

मेट्रिक Qwen3.6 Plus Preview Qwen3.6 Plus Preview medium रिलीज़: 2026-04-20 निःशुल्क उपलब्ध Grok 4.20 Beta Grok 4.20 Beta none रिलीज़: 2026-03-12
स्कोर 8.5 5.3
रैंक #14 #104
विश्वसनीयता लागू नहीं लागू नहीं
संगति 10.0 9.2
सही परीक्षण
प्रति प्रयास पास दर 76.5% 29.6%
अस्थिर टेस्ट 0 2
कुल रन 49 52
प्रति परिणाम लागत 0.000 2.255
कुल लागत $0.000 $0.091
???? ??? $0.000 / 1M $0.000 / 1M
????? ??? $0.000 / 1M $0.000 / 1M
आउटपुट टोकन 1,756 1,591
रीजनिंग टोकन 77,213 0
प्रतिक्रिया समय (औसत) 13.94s 1.19s
प्रतिक्रिया समय (अधिकतम) 43.55s 6.48s
प्रतिक्रिया समय (कुल) 237.01s 21.37s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Qwen3.6 Plus Preview 10.0 10.0 100.0% 0 9.90s 207 7,557
Grok 4.20 Beta 4.0 8.4 16.7% 1 597ms 251 0
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Qwen3.6 Plus Preview 10.0 10.0 100.0% 0 34.95s 452 13,073
Grok 4.20 Beta 3.0 10.0 0.0% 0 6.48s 282 0
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Qwen3.6 Plus Preview 10.0 10.0 100.0% 0 14.95s 270 10,706
Grok 4.20 Beta 10.0 10.0 100.0% 0 601ms 197 0
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Qwen3.6 Plus Preview 3.0 10.0 0.0% 0 22.08s 49 26,895
Grok 4.20 Beta 3.0 10.0 0.0% 0 611ms 160 0
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Qwen3.6 Plus Preview 5.1 10.0 0.0% 0 27.05s 111 5,232
Grok 4.20 Beta 5.0 10.0 0.0% 0 541ms 87 0
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Qwen3.6 Plus Preview 10.0 10.0 100.0% 0 7.54s 102 5,552
Grok 4.20 Beta 4.8 10.0 0.0% 0 687ms 60 0
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Qwen3.6 Plus Preview 10.0 10.0 100.0% 0 6.11s 298 6,868
Grok 4.20 Beta 5.9 7.2 55.6% 1 541ms 291 0
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Qwen3.6 Plus Preview 10.0 10.0 100.0% 0 5.87s 267 1,330
Grok 4.20 Beta 10.0 10.0 100.0% 0 4.79s 189 0
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Qwen3.6 Plus Preview - - - - - - - -
Grok 4.20 Beta 5.5 10.0 0.0% 0 1.14s 74 0

त्वरित तुलना

तुलना जोड़ी बदलें