नेविगेशन
AI BENCHY
Advertise here

AI BENCHY तुलना

Qwen: Qwen3.6 Max Preview vs Qwen: Qwen3.7 Max

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-05-22

मेट्रिक Qwen3.6 Max Preview Qwen3.6 Max Preview medium रिलीज़: 2026-04-20 Qwen3.7 Max Qwen3.7 Max medium रिलीज़: 2026-05-22
स्कोर 8.4 9.0
रैंक #14 #5
विश्वसनीयता 10.0 10.0
संगति 9.2 9.6
सही परीक्षण
प्रति प्रयास पास दर 80.0% 88.3%
अस्थिर टेस्ट 2 1
कुल रन 60 60
प्रति परिणाम लागत 6.906 5.540
कुल लागत $1.036 $0.942
???? ??? $1.040 / 1M $2.500 / 1M
????? ??? $6.240 / 1M $7.500 / 1M
आउटपुट टोकन 2,225 2,109
रीजनिंग टोकन 130,808 110,285
प्रतिक्रिया समय (औसत) 58.41s 13.83s
प्रतिक्रिया समय (अधिकतम) 238.07s 33.37s
प्रतिक्रिया समय (कुल) 1168.27s 276.53s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Qwen3.6 Max Preview 10.0 10.0 100.0% 0 22.13s 228 10,075
Qwen3.7 Max 10.0 10.0 100.0% 0 6.36s 222 8,742
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Qwen3.6 Max Preview 8.2 6.7 83.3% 1 177.97s 407 39,442
Qwen3.7 Max 10.0 10.0 100.0% 0 22.98s 403 22,134
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Qwen3.6 Max Preview 10.0 10.0 100.0% 0 121.49s 390 14,575
Qwen3.7 Max 10.0 10.0 100.0% 0 19.60s 366 8,405
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Qwen3.6 Max Preview 10.0 10.0 100.0% 0 41.15s 270 10,106
Qwen3.7 Max 10.0 10.0 100.0% 0 8.80s 270 6,254
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Qwen3.6 Max Preview 2.9 7.2 11.1% 1 95.91s 60 30,371
Qwen3.7 Max 5.9 7.2 55.6% 1 24.94s 61 31,793
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Qwen3.6 Max Preview 10.0 10.0 100.0% 0 32.24s 129 3,510
Qwen3.7 Max 10.0 10.0 100.0% 0 11.70s 135 4,457
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Qwen3.6 Max Preview 10.0 10.0 100.0% 0 24.31s 103 5,848
Qwen3.7 Max 10.0 10.0 100.0% 0 7.46s 102 5,452
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Qwen3.6 Max Preview 10.0 10.0 100.0% 0 24.19s 301 7,649
Qwen3.7 Max 10.0 10.0 100.0% 0 8.84s 259 8,908
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Qwen3.6 Max Preview 10.0 10.0 100.0% 0 18.32s 309 1,571
Qwen3.7 Max 10.0 10.0 100.0% 0 6.63s 267 1,220
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Qwen3.6 Max Preview 3.0 10.0 0.0% 0 60.56s 28 7,661
Qwen3.7 Max 3.0 10.0 0.0% 0 33.37s 24 12,920

त्वरित तुलना

तुलना जोड़ी बदलें