नेविगेशन
AI BENCHY
Advertise here

GPT-5.4 (medium) vs Inkling Small (high)

GPT-5.4 (medium) average score में आगे है: 8.5 vs 8.4. Inkling Small (high) की benchmark लागत कम है: $0.416 vs $1.533. GPT-5.4 (medium) तेज है: 23.10s vs 31.70s, pass rates 77.3% vs 69.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-01

रैंक
#26
कुल आउटपुट टोकन
88,670
प्रतिक्रिया समय (औसत)
23.10s
कुल लागत
$1.533
रैंक
#30
कुल आउटपुट टोकन
310,388
प्रतिक्रिया समय (औसत)
31.70s
कुल लागत
$0.416
अनुशंसित मॉडल Inkling Small (high)

Its score stays close to the best score here (8.4 vs 8.5), while costing about 3.7x less than GPT-5.4 (medium).

विस्तृत तुलना

मेट्रिक GPT-5.4 GPT-5.4 medium रिलीज़: 2026-03-05 Inkling Small Inkling Small high रिलीज़: 2026-08-01
स्कोर 8.5 8.4
रैंक #26 #30
विश्वसनीयता 10.0 10.0
संगति 8.6 9.2
सही परीक्षण
प्रति प्रयास पास दर 77.3% 69.7%
अस्थिर टेस्ट 4 2
कुल रन 66 66
प्रति परिणाम लागत 10.220 2.967
कुल लागत $1.533 $0.416
इनपुट कीमत $2.500 / 1M $0.500 / 1M
आउटपुट कीमत $15.000 / 1M $1.200 / 1M
कुल इनपुट टोकन 81,127 85,660
आउटपुट टोकन 6,155 6,092
रीजनिंग टोकन 82,515 304,296
प्रतिक्रिया समय (औसत) 23.10s 31.70s
प्रतिक्रिया समय (अधिकतम) 100.41s 122.60s
प्रतिक्रिया समय (कुल) 508.26s 697.30s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#26 GPT-5.4

medium
लागत
$0.214
समय
199.6s
टोकन
14,349 tok

#30 Thinking Machines: Inkling Small

high
लागत
$0.006
समय
34.7s
टोकन
4,735 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.4 8.8 7.8 88.9% 1 44.36s 7,305 433 24,216
Inkling Small 10.0 10.0 100.0% 0 93.23s 7,374 463 120,474

त्वरित तुलना

तुलना जोड़ी बदलें