नेविगेशन
AI BENCHY
Advertise here

GPT-5.2 (medium) vs Inkling Small (high)

average score लगभग बराबर है: 8.4 vs 8.4. Inkling Small (high) की benchmark लागत कम है: $0.416 vs $0.951. GPT-5.2 (medium) तेज है: 22.62s vs 31.70s, pass rates 72.7% vs 69.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-01

रैंक
#29
कुल आउटपुट टोकन
54,782
प्रतिक्रिया समय (औसत)
22.62s
कुल लागत
$0.951
रैंक
#30
कुल आउटपुट टोकन
310,388
प्रतिक्रिया समय (औसत)
31.70s
कुल लागत
$0.416
अनुशंसित मॉडल Inkling Small (high)

It has the best score here (8.4), while costing about 2.3x less than GPT-5.2 (medium).

विस्तृत तुलना

मेट्रिक GPT-5.2 GPT-5.2 medium रिलीज़: 2025-12-11 Inkling Small Inkling Small high रिलीज़: 2026-08-01
स्कोर 8.4 8.4
रैंक #29 #30
विश्वसनीयता 10.0 10.0
संगति 8.5 9.2
सही परीक्षण
प्रति प्रयास पास दर 72.7% 69.7%
अस्थिर टेस्ट 4 2
कुल रन 66 66
प्रति परिणाम लागत 6.791 2.967
कुल लागत $0.951 $0.416
इनपुट कीमत $1.750 / 1M $0.500 / 1M
आउटपुट कीमत $14.000 / 1M $1.200 / 1M
कुल इनपुट टोकन 105,004 85,660
आउटपुट टोकन 9,914 6,092
रीजनिंग टोकन 44,868 304,296
प्रतिक्रिया समय (औसत) 22.62s 31.70s
प्रतिक्रिया समय (अधिकतम) 102.93s 122.60s
प्रतिक्रिया समय (कुल) 339.28s 697.30s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#29 GPT-5.2

medium
लागत
$0.047
समय
49.2s
टोकन
3,396 tok

#30 Thinking Machines: Inkling Small

high
लागत
$0.006
समय
34.7s
टोकन
4,735 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.2 10.0 10.0 100.0% 0 22.73s 7,302 511 11,912
Inkling Small 10.0 10.0 100.0% 0 93.23s 7,374 463 120,474

त्वरित तुलना

तुलना जोड़ी बदलें