नेविगेशन
Advertise here

GPT 5.3 Chat (default) vs GPT-5.6 Sol

average score लगभग बराबर है: 6.7 vs 6.7. GPT 5.3 Chat (default) की benchmark लागत कम है: $0.533 vs $0.795. GPT-5.6 Sol तेज है: 4.61s vs 6.31s, pass rates 62.3% vs 60.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-07

तुलना किए गए मॉडल

रैंक
#193
कुल आउटपुट टोकन
28,179
प्रतिक्रिया समय (औसत)
6.31s
कुल लागत
$0.533
रैंक
#194
कुल आउटपुट टोकन
5,555
प्रतिक्रिया समय (औसत)
4.61s
कुल लागत
$0.795
अनुशंसित मॉडल GPT 5.3 Chat (default)

इस तुलना में इसका स्कोर सबसे अधिक है (6.7) और 2 मॉडलों में लागत और प्रतिक्रिया समय का समग्र संतुलन सबसे अच्छा है।

विस्तृत तुलना

मेट्रिक GPT 5.3 Chat GPT 5.3 Chat default रिलीज़: 2026-03-03 GPT-5.6 Sol GPT-5.6 Sol none रिलीज़: 2026-07-09
स्कोर 6.7 6.7
रैंक #193 #194
विश्वसनीयता 10.0 10.0
संगति 8.6 9.1
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 62.3% 60.9%
अस्थिर टेस्ट 4 3
कुल रन 69 69
प्रति परिणाम लागत 4.097 6.619
कुल लागत $0.533 $0.795
इनपुट कीमत $1.750 / 1M $2.000 / 1M
आउटपुट कीमत $14.000 / 1M $10.000 / 1M
कैश पढ़ने की कीमत लागू नहीं $0.200 / 1M
कैश लिखने की कीमत लागू नहीं $2.500 / 1M
कुल इनपुट टोकन 78,846 207,852
आउटपुट टोकन 7,635 5,555
रीजनिंग टोकन 20,544 0
प्रतिक्रिया समय (औसत) 6.31s 4.61s
प्रतिक्रिया समय (अधिकतम) 18.33s 58.28s
प्रतिक्रिया समय (कुल) 138.73s 105.93s
पैरामीटर ~400B कुल (~17B सक्रिय) ~2T कुल (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#193 GPT 5.3 Chat

default
लागत
$0.008
समय
8.1s
टोकन
634 tok

#194 GPT-5.6 Sol

none
लागत
$0.116
समय
78.7s
टोकन
3,944 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT 5.3 Chat 5.6 4.7 55.6% 2 10.52s 7,302 808 5,824
GPT-5.6 Sol 5.5 10.0 33.3% 0 1.39s 7,302 390 0

तुलना जोड़ी बदलें