नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY तुलना

OpenAI: GPT-5.3 Chat vs OpenAI: GPT-5.4 Nano

सारांश

GPT-5.3 Chat vs GPT-5.4 Nano benchmark तुलना: average score लगभग बराबर है: 7.5 vs 7.5. GPT-5.4 Nano की benchmark लागत कम है: $0.107 vs $0.433. GPT-5.3 Chat तेज है: 6.34s vs 11.95s, pass rates 66.7% vs 63.5%.

अनुशंसित मॉडल: GPT-5.4 Nano - It has the best score here (7.5), while costing about 4.1x less than GPT-5.3 Chat.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-06-12

मेट्रिक GPT-5.3 Chat GPT-5.3 Chat none रिलीज़: 2026-03-03 GPT-5.4 Nano GPT-5.4 Nano medium रिलीज़: 2026-03-17
स्कोर 7.5 7.5
रैंक #47 #48
विश्वसनीयता 10.0 10.0
संगति 8.1 8.4
सही परीक्षण
प्रति प्रयास पास दर 66.7% 63.5%
अस्थिर टेस्ट 5 4
कुल रन 63 63
प्रति परिणाम लागत 3.605 0.969
कुल लागत $0.433 $0.107
इनपुट कीमत $1.750 / 1M $0.200 / 1M
आउटपुट कीमत $14.000 / 1M $1.250 / 1M
कुल इनपुट टोकन 34,209 35,434
आउटपुट टोकन 26,617 3,014
रीजनिंग टोकन 0 76,520
प्रतिक्रिया समय (औसत) 6.34s 11.95s
प्रतिक्रिया समय (अधिकतम) 18.33s 94.06s
प्रतिक्रिया समय (कुल) 133.13s 250.98s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#47 GPT-5.3 Chat

none
Cost
$0.008
Time
8.1s
Tokens
634 tok

#48 GPT-5.4 Nano

medium
Cost
$0.007
Time
24.6s
Tokens
4,943 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.3 Chat 6.7 8.1 58.3% 1 3.86s 606 3,167 0
GPT-5.4 Nano 8.3 10.0 75.0% 0 4.52s 606 683 2,254
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.3 Chat 5.6 4.7 55.6% 2 10.52s 7,302 6,632 0
GPT-5.4 Nano 6.1 4.7 66.7% 2 19.12s 7,305 516 20,778
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.3 Chat 10.0 10.0 100.0% 0 11.96s 11,019 2,614 0
GPT-5.4 Nano 9.8 10.0 100.0% 0 24.13s 12,345 349 5,719
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.3 Chat 10.0 10.0 100.0% 0 2.21s 7,140 942 0
GPT-5.4 Nano 10.0 10.0 100.0% 0 2.54s 7,140 234 516
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.3 Chat 3.5 4.4 33.3% 2 13.01s 723 8,264 0
GPT-5.4 Nano 5.9 7.2 55.6% 1 38.18s 619 60 43,325
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.3 Chat 4.6 10.0 0.0% 0 1.99s 477 319 0
GPT-5.4 Nano 4.5 10.0 0.0% 0 4.15s 477 179 443
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.3 Chat 9.8 10.0 100.0% 0 3.51s 660 1,491 0
GPT-5.4 Nano 9.8 10.0 100.0% 0 1.88s 660 95 521
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.3 Chat 10.0 10.0 100.0% 0 2.99s 642 1,758 0
GPT-5.4 Nano 4.1 7.2 22.2% 1 3.79s 642 594 1,408
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.3 Chat 10.0 10.0 100.0% 0 8.36s 5,445 861 0
GPT-5.4 Nano 10.0 10.0 100.0% 0 7.71s 5,445 234 382
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.3 Chat 3.0 10.0 0.0% 0 4.38s 195 569 0
GPT-5.4 Nano 3.0 10.0 0.0% 0 4.81s 195 70 1,174

त्वरित तुलना

तुलना जोड़ी बदलें