नेविगेशन
AI BENCHY
Your ad here

AI BENCHY तुलना

OpenAI: GPT-5.2 Chat vs Hunter Alpha

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-03-17

मेट्रिक GPT-5.2 Chat GPT-5.2 Chat none रिलीज़: 2025-12-11 Hunter Alpha Hunter Alpha medium रिलीज़: रिलीज़ तिथि अज्ञात
रैंक #24 #35
स्कोर 7.8 7.0
संगति 8.6 7.2
प्रति परिणाम लागत 2.462 0.000
कुल लागत $0.271 $0.000
सही परीक्षण
प्रति प्रयास पास दर 74.5% 68.6%
अस्थिर टेस्ट 3 6
कुल रन 51 51
आउटपुट टोकन 16,001 4,724
रीजनिंग टोकन 0 17,921
प्रतिक्रिया समय (औसत) 6.72s 10.33s
प्रतिक्रिया समय (अधिकतम) 38.52s 30.53s
प्रतिक्रिया समय (कुल) 114.20s 175.60s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.2 Chat 8.7 7.9 91.7% 1 3.40s 1,807 0
Hunter Alpha 7.3 5.8 83.3% 2 4.75s 479 1,103
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.2 Chat 10.0 10.0 100.0% 0 9.12s 1,243 0
Hunter Alpha 4.7 1.6 66.7% 1 30.53s 792 3,456
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.2 Chat 10.0 10.0 100.0% 0 3.05s 980 0
Hunter Alpha 10.0 10.0 100.0% 0 23.16s 1,488 8,017
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.2 Chat 5.3 10.0 33.3% 0 17.78s 7,810 0
Hunter Alpha 3.0 10.0 0.0% 0 10.52s 892 2,406
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.2 Chat 4.4 3.0 33.3% 1 3.20s 335 0
Hunter Alpha 7.0 3.7 66.7% 1 6.44s 116 260
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.2 Chat 7.5 6.1 83.3% 1 5.46s 1,528 0
Hunter Alpha 9.9 10.0 100.0% 0 4.18s 208 465
Puzzle Solving स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.2 Chat 7.7 10.0 66.7% 0 4.42s 1,743 0
Hunter Alpha 6.1 4.7 66.7% 2 5.36s 441 1,310
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.2 Chat 10.0 10.0 100.0% 0 4.68s 555 0
Hunter Alpha 10.0 10.0 100.0% 0 17.33s 308 904

त्वरित तुलना

तुलना जोड़ी बदलें