नेविगेशन
AI BENCHY
Your ad here

AI BENCHY तुलना

OpenAI: GPT-5.4 vs HY3 Preview

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-04-23

मेट्रिक GPT-5.4 GPT-5.4 medium रिलीज़: 2026-03-05 HY3 Preview HY3 Preview low रिलीज़: 2026-04-22 निःशुल्क उपलब्ध
स्कोर 8.2 8.1
रैंक #17 #22
संगति 8.7 9.5
सही परीक्षण
प्रति प्रयास पास दर 79.6% 75.9%
अस्थिर टेस्ट 3 1
कुल रन 54 50
प्रति परिणाम लागत 6.399 0.000
कुल लागत $0.832 $0.000
???? ??? $2.500 / 1M $0.000 / 1M
????? ??? $15.000 / 1M $0.000 / 1M
आउटपुट टोकन 2,169 65,778
रीजनिंग टोकन 48,732 0
प्रतिक्रिया समय (औसत) 18.63s 23.98s
प्रतिक्रिया समय (अधिकतम) 100.41s 78.74s
प्रतिक्रिया समय (कुल) 335.26s 407.72s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 8.3 10.0 75.0% 0 4.11s 240 1,511
HY3 Preview 10.0 10.0 100.0% 0 16.61s 7,905 0
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 10.0 10.0 100.0% 0 13.03s 389 2,045
HY3 Preview 10.0 10.0 100.0% 0 27.94s 7,907 0
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 10.0 10.0 100.0% 0 20.57s 301 3,543
HY3 Preview 10.0 10.0 100.0% 0 78.74s 12,975 0
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 10.0 10.0 100.0% 0 5.32s 234 804
HY3 Preview 6.5 10.0 50.0% 0 5.85s 1,022 0
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 5.3 7.2 44.4% 1 74.27s 61 34,748
HY3 Preview 5.9 7.2 55.6% 1 40.44s 23,121 0
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 4.7 3.1 33.3% 1 4.92s 145 321
HY3 Preview 10.0 10.0 100.0% 0 16.44s 2,185 0
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 10.0 10.0 100.0% 0 3.11s 93 897
HY3 Preview 10.0 10.0 100.0% 0 15.98s 2,475 0
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 8.2 7.2 88.9% 1 9.13s 442 3,832
HY3 Preview 5.3 10.0 33.3% 0 13.73s 6,985 0
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 10.0 10.0 100.0% 0 13.28s 264 1,031
HY3 Preview 10.0 10.0 100.0% 0 17.84s 1,203 0

त्वरित तुलना

तुलना जोड़ी बदलें