नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY तुलना

OpenAI: GPT-5.4 vs OpenAI: GPT-5.5

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-04-26

मेट्रिक GPT-5.4 GPT-5.4 medium रिलीज़: 2026-03-05 GPT-5.5 GPT-5.5 low रिलीज़: 2026-04-24
स्कोर 8.2 9.0
रैंक #19 #5
विश्वसनीयता लागू नहीं 10.0
संगति 8.7 9.6
सही परीक्षण
प्रति प्रयास पास दर 79.6% 87.0%
अस्थिर टेस्ट 3 1
कुल रन 54 54
प्रति परिणाम लागत 6.399 4.534
कुल लागत $0.832 $0.681
???? ??? $2.500 / 1M $5.000 / 1M
????? ??? $15.000 / 1M $30.000 / 1M
आउटपुट टोकन 2,169 1,959
रीजनिंग टोकन 48,732 16,134
प्रतिक्रिया समय (औसत) 18.63s 8.39s
प्रतिक्रिया समय (अधिकतम) 100.41s 56.19s
प्रतिक्रिया समय (कुल) 335.26s 151.01s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 8.3 10.0 75.0% 0 4.11s 240 1,511
GPT-5.5 10.0 10.0 100.0% 0 4.15s 232 1,056
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 10.0 10.0 100.0% 0 13.03s 389 2,045
GPT-5.5 10.0 10.0 100.0% 0 7.79s 369 936
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 10.0 10.0 100.0% 0 20.57s 301 3,543
GPT-5.5 10.0 10.0 100.0% 0 9.56s 303 717
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 10.0 10.0 100.0% 0 5.32s 234 804
GPT-5.5 10.0 10.0 100.0% 0 3.28s 228 157
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 5.3 7.2 44.4% 1 74.27s 61 34,748
GPT-5.5 5.3 10.0 33.3% 0 27.57s 69 11,731
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 4.7 3.1 33.3% 1 4.92s 145 321
GPT-5.5 10.0 10.0 100.0% 0 3.45s 143 132
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 10.0 10.0 100.0% 0 3.11s 93 897
GPT-5.5 9.9 10.0 100.0% 0 2.98s 93 356
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 8.2 7.2 88.9% 1 9.13s 442 3,832
GPT-5.5 9.0 7.9 88.9% 1 4.48s 272 948
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 10.0 10.0 100.0% 0 13.28s 264 1,031
GPT-5.5 10.0 10.0 100.0% 0 4.96s 250 101

त्वरित तुलना

तुलना जोड़ी बदलें