नेविगेशन
Advertise here

Claude Sonnet 4.6 vs GPT-5.4 Mini (medium)

GPT-5.4 Mini (medium) average score में आगे है: 7.5 vs 7.3. Claude Sonnet 4.6 की benchmark लागत कम है: $0.661 vs $0.786. Claude Sonnet 4.6 तेज है: 7.67s vs 26.72s, pass rates 57.6% vs 68.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-21

तुलना किए गए मॉडल

रैंक
#126
कुल आउटपुट टोकन
19,362
प्रतिक्रिया समय (औसत)
7.67s
कुल लागत
$0.661
रैंक
#115
कुल आउटपुट टोकन
158,344
प्रतिक्रिया समय (औसत)
26.72s
कुल लागत
$0.786
अनुशंसित मॉडल Claude Sonnet 4.6

Its score stays close to the best score here (7.3 vs 7.5), while responding about 3.5x faster than GPT-5.4 Mini (medium).

विस्तृत तुलना

मेट्रिक Claude Sonnet 4.6 Claude Sonnet 4.6 none रिलीज़: 2026-02-17 GPT-5.4 Mini GPT-5.4 Mini medium रिलीज़: 2026-03-17
स्कोर 7.3 7.5
रैंक #126 #115
विश्वसनीयता 10.0 10.0
संगति 9.7 8.1
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 57.6% 68.2%
अस्थिर टेस्ट 1 5
कुल रन 66 66
प्रति परिणाम लागत 5.503 6.546
कुल लागत $0.661 $0.786
इनपुट कीमत $3.000 / 1M $0.750 / 1M
आउटपुट कीमत $15.000 / 1M $4.500 / 1M
कुल इनपुट टोकन 123,273 97,164
आउटपुट टोकन 19,362 6,211
रीजनिंग टोकन 0 152,133
प्रतिक्रिया समय (औसत) 7.67s 26.72s
प्रतिक्रिया समय (अधिकतम) 51.18s 138.75s
प्रतिक्रिया समय (कुल) 122.78s 587.90s
पैरामीटर ~1T कुल (~100B सक्रिय) ~400B कुल (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#126 Claude Sonnet 4.6

none
लागत
$0.038
समय
27.3s
टोकन
2,598 tok

#115 GPT-5.4 Mini

medium
लागत
$0.056
समय
95.5s
टोकन
12,464 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 5.5 10.0 33.3% 0 5.19s 8,522 2,127 0
GPT-5.4 Mini 8.4 7.4 88.9% 1 57.87s 7,305 467 40,902

त्वरित तुलना

तुलना जोड़ी बदलें