नेविगेशन
Advertise here

Claude Opus 5 vs GPT-5.4 Mini (medium)

Claude Opus 5 average score में आगे है: 7.5 vs 7.5. GPT-5.4 Mini (medium) की benchmark लागत कम है: $0.786 vs $1.550. Claude Opus 5 तेज है: 7.65s vs 26.72s, pass rates 57.6% vs 68.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-07

तुलना किए गए मॉडल

रैंक
#97
कुल आउटपुट टोकन
24,866
प्रतिक्रिया समय (औसत)
7.65s
कुल लागत
$1.550
रैंक
#105
कुल आउटपुट टोकन
158,344
प्रतिक्रिया समय (औसत)
26.72s
कुल लागत
$0.786
अनुशंसित मॉडल Claude Opus 5

It has the best score here (7.5), while responding about 3.5x faster than GPT-5.4 Mini (medium).

विस्तृत तुलना

मेट्रिक Claude Opus 5 Claude Opus 5 none रिलीज़: 2026-07-25 GPT-5.4 Mini GPT-5.4 Mini medium रिलीज़: 2026-03-17
स्कोर 7.5 7.5
रैंक #97 #105
विश्वसनीयता 10.0 10.0
संगति 9.6 8.1
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 57.6% 68.2%
अस्थिर टेस्ट 1 5
कुल रन 66 66
प्रति परिणाम लागत 12.912 6.546
कुल लागत $1.550 $0.786
इनपुट कीमत $5.000 / 1M $0.750 / 1M
आउटपुट कीमत $25.000 / 1M $4.500 / 1M
कुल इनपुट टोकन 185,547 97,164
आउटपुट टोकन 24,866 6,211
रीजनिंग टोकन 0 152,133
प्रतिक्रिया समय (औसत) 7.65s 26.72s
प्रतिक्रिया समय (अधिकतम) 47.72s 138.75s
प्रतिक्रिया समय (कुल) 168.35s 587.90s
पैरामीटर ~5T कुल (~500B सक्रिय) ~400B कुल (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#97 Claude Opus 5

none
लागत
$0.271
समय
149.3s
टोकन
10,962 tok

#105 GPT-5.4 Mini

medium
लागत
$0.056
समय
95.5s
टोकन
12,464 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Opus 5 5.9 9.7 33.3% 0 5.54s 10,590 2,886 0
GPT-5.4 Mini 8.4 7.4 88.9% 1 57.87s 7,305 467 40,902

त्वरित तुलना

तुलना जोड़ी बदलें