नेविगेशन
AI BENCHY
Your ad here

AI BENCHY तुलना

OpenAI: GPT-5.4 Mini vs Hunter Alpha

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-03-17

मेट्रिक GPT-5.4 Mini GPT-5.4 Mini medium रिलीज़: 2026-03-17 Hunter Alpha Hunter Alpha medium रिलीज़: रिलीज़ तिथि अज्ञात
रैंक #34 #35
स्कोर 7.1 7.0
संगति 7.2 7.2
प्रति परिणाम लागत 3.610 0.000
कुल लागत $0.289 $0.000
सही परीक्षण
प्रति प्रयास पास दर 68.6% 68.6%
अस्थिर टेस्ट 6 6
कुल रन 51 51
आउटपुट टोकन 1,708 4,724
रीजनिंग टोकन 58,019 17,921
प्रतिक्रिया समय (औसत) 15.66s 10.33s
प्रतिक्रिया समय (अधिकतम) 102.91s 30.53s
प्रतिक्रिया समय (कुल) 266.14s 175.60s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 Mini 8.6 7.9 91.7% 1 4.05s 296 2,876
Hunter Alpha 7.3 5.8 83.3% 2 4.75s 479 1,103
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 Mini 10.0 10.0 100.0% 0 17.81s 317 4,317
Hunter Alpha 4.7 1.6 66.7% 1 30.53s 792 3,456
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 Mini 10.0 10.0 100.0% 0 2.43s 234 650
Hunter Alpha 10.0 10.0 100.0% 0 23.16s 1,488 8,017
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 Mini 4.1 4.4 44.5% 2 65.31s 60 43,286
Hunter Alpha 3.0 10.0 0.0% 0 10.52s 892 2,406
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 Mini 4.5 10.0 0.0% 0 3.72s 150 510
Hunter Alpha 7.0 3.7 66.7% 1 6.44s 116 260
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 Mini 7.4 6.5 66.7% 1 2.50s 129 1,337
Hunter Alpha 9.9 10.0 100.0% 0 4.18s 208 465
Puzzle Solving स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 Mini 6.8 7.9 55.6% 1 4.33s 271 2,449
Hunter Alpha 6.1 4.7 66.7% 2 5.36s 441 1,310
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 Mini 4.7 1.6 66.7% 1 9.62s 251 2,594
Hunter Alpha 10.0 10.0 100.0% 0 17.33s 308 904

त्वरित तुलना

तुलना जोड़ी बदलें