नेविगेशन
AI BENCHY
Your ad here

AI BENCHY तुलना

OpenAI: GPT-5.5 vs Qwen: Qwen3.6 Flash

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-04-27

मेट्रिक GPT-5.5 GPT-5.5 medium रिलीज़: 2026-04-24 Qwen3.6 Flash Qwen3.6 Flash medium रिलीज़: 2026-04-20
स्कोर 9.0 8.1
रैंक #6 #24
विश्वसनीयता लागू नहीं 10.0
संगति 9.2 8.2
सही परीक्षण
प्रति प्रयास पास दर 87.0% 79.6%
अस्थिर टेस्ट 2 4
कुल रन 54 54
प्रति परिणाम लागत 19.226 1.449
कुल लागत $2.884 $0.174
???? ??? $5.000 / 1M $0.250 / 1M
????? ??? $30.000 / 1M $1.500 / 1M
आउटपुट टोकन 1,920 2,804
रीजनिंग टोकन 89,632 107,210
प्रतिक्रिया समय (औसत) 32.75s 9.90s
प्रतिक्रिया समय (अधिकतम) 332.10s 26.85s
प्रतिक्रिया समय (कुल) 589.59s 178.26s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.5 10.0 10.0 100.0% 0 4.66s 250 1,335
Qwen3.6 Flash 10.0 10.0 100.0% 0 6.10s 624 14,024
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.5 10.0 10.0 100.0% 0 9.09s 318 1,391
Qwen3.6 Flash 6.7 3.5 66.7% 1 25.84s 435 17,044
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.5 10.0 10.0 100.0% 0 19.29s 312 2,841
Qwen3.6 Flash 10.0 10.0 100.0% 0 20.28s 483 13,839
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.5 10.0 10.0 100.0% 0 4.18s 234 593
Qwen3.6 Flash 10.0 10.0 100.0% 0 9.65s 270 13,155
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.5 5.3 7.2 44.4% 1 164.14s 67 79,625
Qwen3.6 Flash 3.5 4.4 33.3% 2 14.65s 60 24,409
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.5 10.0 10.0 100.0% 0 4.16s 138 223
Qwen3.6 Flash 4.8 9.9 0.0% 0 9.88s 140 5,445
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.5 10.0 10.0 100.0% 0 3.36s 93 538
Qwen3.6 Flash 10.0 10.0 100.0% 0 6.05s 102 7,423
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.5 8.6 7.9 77.8% 1 6.78s 250 2,254
Qwen3.6 Flash 8.2 7.2 88.9% 1 6.17s 355 10,683
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.5 10.0 10.0 100.0% 0 10.57s 258 832
Qwen3.6 Flash 10.0 10.0 100.0% 0 4.00s 335 1,188

त्वरित तुलना

तुलना जोड़ी बदलें