नेविगेशन
Advertise here

Claude Sonnet 5.5 (medium) vs GPT-5.4

GPT-5.4 average score में आगे है: 5.8 vs 5.7. GPT-5.4 की benchmark लागत कम है: $0.397 vs $0.672. GPT-5.4 तेज है: 2.08s vs 6.07s, pass rates 37.9% vs 34.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-29

तुलना किए गए मॉडल

रैंक
#266
कुल आउटपुट टोकन
32,980
प्रतिक्रिया समय (औसत)
6.07s
कुल लागत
$0.672
रैंक
#263
कुल आउटपुट टोकन
8,339
प्रतिक्रिया समय (औसत)
2.08s
कुल लागत
$0.397
अनुशंसित मॉडल GPT-5.4

It has the best score here (5.8), while costing about 1.7x less than Claude Sonnet 5.5 (medium).

विस्तृत तुलना

मेट्रिक Claude Sonnet 5.5 Claude Sonnet 5.5 medium रिलीज़: 2026-09-29 GPT-5.4 GPT-5.4 none रिलीज़: 2026-03-05
स्कोर 5.7 5.8
रैंक #266 #263
विश्वसनीयता 10.0 10.0
संगति 9.7 9.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 37.9% 34.9%
अस्थिर टेस्ट 1 2
कुल रन 66 66
प्रति परिणाम लागत 8.392 5.667
कुल लागत $0.672 $0.397
इनपुट कीमत $2.000 / 1M $2.500 / 1M
आउटपुट कीमत $10.000 / 1M $15.000 / 1M
कुल इनपुट टोकन 170,771 108,641
आउटपुट टोकन 23,185 8,339
रीजनिंग टोकन 9,795 0
प्रतिक्रिया समय (औसत) 6.07s 2.08s
प्रतिक्रिया समय (अधिकतम) 26.16s 15.63s
प्रतिक्रिया समय (कुल) 133.62s 45.75s
पैरामीटर ~1T कुल (~100B सक्रिय) ~1.5T कुल (~100B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#266 Claude Sonnet 5.5

medium
लागत
$0.024
समय
17.4s
टोकन
2,525 tok

#263 GPT-5.4

none
लागत
$0.026
समय
18.1s
टोकन
1,792 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 5.5 3.4 9.7 0.0% 0 6.07s 10,608 6,767 0
GPT-5.4 5.5 10.0 33.3% 0 1.62s 7,305 516 0

त्वरित तुलना

तुलना जोड़ी बदलें