नेविगेशन
AI BENCHY
Advertise here

Claude Sonnet 4.6 vs GPT-5.4 Nano (medium)

GPT-5.4 Nano (medium) average score में आगे है: 7.5 vs 7.3. GPT-5.4 Nano (medium) की benchmark लागत कम है: $0.138 vs $0.661. Claude Sonnet 4.6 तेज है: 8.12s vs 13.24s, pass rates 57.6% vs 65.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-05

रैंक
#81
कुल आउटपुट टोकन
19,362
प्रतिक्रिया समय (औसत)
8.12s
कुल लागत
$0.661
रैंक
#71
कुल आउटपुट टोकन
97,122
प्रतिक्रिया समय (औसत)
13.24s
कुल लागत
$0.138
अनुशंसित मॉडल GPT-5.4 Nano (medium)

It has the best score here (7.5), while costing about 4.8x less than Claude Sonnet 4.6.

विस्तृत तुलना

मेट्रिक Claude Sonnet 4.6 Claude Sonnet 4.6 none रिलीज़: 2026-02-17 GPT-5.4 Nano GPT-5.4 Nano medium रिलीज़: 2026-03-17
स्कोर 7.3 7.5
रैंक #81 #71
विश्वसनीयता 10.0 10.0
संगति 9.7 8.5
बेंचमार्क कवरेज 22/22 टेस्ट · 66/66 प्रयास 22/22 टेस्ट · 66/66 प्रयास
सही परीक्षण
प्रति प्रयास पास दर 57.6% 65.2%
अस्थिर टेस्ट 1 4
कुल रन 66 66
प्रति परिणाम लागत 5.502 1.150
कुल लागत $0.661 $0.138
इनपुट कीमत $3.000 / 1M $0.200 / 1M
आउटपुट कीमत $15.000 / 1M $1.250 / 1M
कुल इनपुट टोकन 123,264 82,819
आउटपुट टोकन 19,362 7,100
रीजनिंग टोकन 0 90,022
प्रतिक्रिया समय (औसत) 8.12s 13.24s
प्रतिक्रिया समय (अधिकतम) 51.18s 94.06s
प्रतिक्रिया समय (कुल) 121.78s 291.33s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#81 Claude Sonnet 4.6

none
लागत
$0.038
समय
27.3s
टोकन
2,598 tok

#71 GPT-5.4 Nano

medium
लागत
$0.007
समय
24.6s
टोकन
4,943 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 5.5 10.0 33.3% 0 5.19s 8,522 2,127 0
GPT-5.4 Nano 6.1 4.7 66.7% 2 19.12s 7,305 516 20,778

त्वरित तुलना

तुलना जोड़ी बदलें