नेविगेशन
AI BENCHY
Advertise here

Claude Sonnet 4.6 vs GPT-5.4 Mini (medium)

GPT-5.4 Mini (medium) average score में आगे है: 7.5 vs 7.3. Claude Sonnet 4.6 की benchmark लागत कम है: $0.661 vs $0.756. Claude Sonnet 4.6 तेज है: 8.12s vs 25.94s, pass rates 57.6% vs 71.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-28

रैंक
#72
कुल आउटपुट टोकन
19,362
प्रतिक्रिया समय (औसत)
8.12s
कुल लागत
$0.661
रैंक
#65
कुल आउटपुट टोकन
151,755
प्रतिक्रिया समय (औसत)
25.94s
कुल लागत
$0.756
अनुशंसित मॉडल Claude Sonnet 4.6

Its score stays close to the best score here (7.3 vs 7.5), while responding about 3.2x faster than GPT-5.4 Mini (medium).

विस्तृत तुलना

मेट्रिक Claude Sonnet 4.6 Claude Sonnet 4.6 none रिलीज़: 2026-02-17 GPT-5.4 Mini GPT-5.4 Mini medium रिलीज़: 2026-03-17
स्कोर 7.3 7.5
रैंक #72 #65
विश्वसनीयता 10.0 10.0
संगति 9.7 7.7
सही परीक्षण
प्रति प्रयास पास दर 57.6% 71.2%
अस्थिर टेस्ट 1 6
कुल रन 66 66
प्रति परिणाम लागत 5.502 6.299
कुल लागत $0.661 $0.756
इनपुट कीमत $3.000 / 1M $0.750 / 1M
आउटपुट कीमत $15.000 / 1M $4.500 / 1M
कुल इनपुट टोकन 123,264 97,155
आउटपुट टोकन 19,362 6,211
रीजनिंग टोकन 0 145,544
प्रतिक्रिया समय (औसत) 8.12s 25.94s
प्रतिक्रिया समय (अधिकतम) 51.18s 138.75s
प्रतिक्रिया समय (कुल) 121.78s 570.66s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#72 Claude Sonnet 4.6

none
लागत
$0.038
समय
27.3s
टोकन
2,598 tok

#65 GPT-5.4 Mini

medium
लागत
$0.056
समय
95.5s
टोकन
12,464 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 5.5 10.0 33.3% 0 5.19s 8,522 2,127 0
GPT-5.4 Mini 8.4 7.4 88.9% 1 57.87s 7,305 467 40,902

त्वरित तुलना

तुलना जोड़ी बदलें