नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY तुलना

OpenAI: GPT-5.2 vs HY3 Preview

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-04-30

मेट्रिक GPT-5.2 GPT-5.2 medium रिलीज़: 2025-12-11 HY3 Preview HY3 Preview low रिलीज़: 2026-04-22 निःशुल्क उपलब्ध
स्कोर 7.5 8.1
रैंक #53 #28
विश्वसनीयता लागू नहीं लागू नहीं
संगति 8.1 9.5
सही परीक्षण
प्रति प्रयास पास दर 72.2% 75.9%
अस्थिर टेस्ट 4 1
कुल रन 54 50
प्रति परिणाम लागत 3.193 0.000
कुल लागत $0.352 $0.000
???? ??? $1.750 / 1M $0.000 / 1M
????? ??? $14.000 / 1M $0.000 / 1M
आउटपुट टोकन 2,705 65,778
रीजनिंग टोकन 18,977 0
प्रतिक्रिया समय (औसत) 14.04s 23.98s
प्रतिक्रिया समय (अधिकतम) 77.80s 78.74s
प्रतिक्रिया समय (कुल) 154.41s 407.72s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.2 6.5 8.0 58.3% 1 7.81s 567 2,002
HY3 Preview 10.0 10.0 100.0% 0 16.61s 7,905 0
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.2 10.0 10.0 100.0% 0 15.12s 467 2,166
HY3 Preview 10.0 10.0 100.0% 0 27.94s 7,907 0
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.2 10.0 10.0 100.0% 0 14.06s 291 1,757
HY3 Preview 10.0 10.0 100.0% 0 78.74s 12,975 0
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.2 10.0 10.0 100.0% 0 3.15s 234 420
HY3 Preview 6.5 10.0 50.0% 0 5.85s 1,022 0
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.2 5.9 7.2 55.6% 1 77.80s 42 10,342
HY3 Preview 5.9 7.2 55.6% 1 40.44s 23,121 0
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.2 3.7 9.7 0.0% 0 4.32s 162 269
HY3 Preview 10.0 10.0 100.0% 0 16.44s 2,185 0
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.2 9.9 10.0 100.0% 0 3.12s 94 614
HY3 Preview 10.0 10.0 100.0% 0 15.98s 2,475 0
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.2 7.7 7.3 77.8% 1 5.47s 609 938
HY3 Preview 5.3 10.0 33.3% 0 13.73s 6,985 0
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.2 4.7 1.6 66.7% 1 10.30s 239 469
HY3 Preview 10.0 10.0 100.0% 0 17.84s 1,203 0

त्वरित तुलना

तुलना जोड़ी बदलें