नेव्हिगेशन
AI BENCHY
Advertise here

GPT-5.2 (medium) vs Inkling Small (high)

average score जवळपास समान आहे: 8.4 vs 8.4. Inkling Small (high) चा benchmark खर्च कमी आहे: $0.416 vs $0.951. GPT-5.2 (medium) वेगवान आहे: 22.62s vs 31.70s, pass rates 72.7% vs 69.7%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-01

क्रमांक
#29
एकूण आउटपुट टोकन्स
54,782
प्रतिसाद वेळ (सरासरी)
22.62s
एकूण खर्च
$0.951
क्रमांक
#30
एकूण आउटपुट टोकन्स
310,388
प्रतिसाद वेळ (सरासरी)
31.70s
एकूण खर्च
$0.416
शिफारस केलेले मॉडेल Inkling Small (high)

It has the best score here (8.4), while costing about 2.3x less than GPT-5.2 (medium).

तपशीलवार तुलना

मेट्रिक GPT-5.2 GPT-5.2 medium प्रकाशन: 2025-12-11 Inkling Small Inkling Small high प्रकाशन: 2026-08-01
स्कोअर 8.4 8.4
क्रमांक #29 #30
विश्वसनीयता 10.0 10.0
सुसंगतता 8.5 9.2
बरोबर चाचण्या
प्रति प्रयत्न पास दर 72.7% 69.7%
अस्थिर चाचण्या 4 2
एकूण रन 66 66
प्रति निकाल खर्च 6.791 2.967
एकूण खर्च $0.951 $0.416
इनपुट किंमत $1.750 / 1M $0.500 / 1M
आउटपुट किंमत $14.000 / 1M $1.200 / 1M
एकूण इनपुट टोकन्स 105,004 85,660
आउटपुट टोकन्स 9,914 6,092
रिझनिंग टोकन्स 44,868 304,296
प्रतिसाद वेळ (सरासरी) 22.62s 31.70s
प्रतिसाद वेळ (कमाल) 102.93s 122.60s
प्रतिसाद वेळ (एकूण) 339.28s 697.30s

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#29 GPT-5.2

medium
खर्च
$0.047
वेळ
49.2s
टोकन्स
3,396 tok

#30 Thinking Machines: Inkling Small

high
खर्च
$0.006
वेळ
34.7s
टोकन्स
4,735 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.2 10.0 10.0 100.0% 0 22.73s 7,302 511 11,912
Inkling Small 10.0 10.0 100.0% 0 93.23s 7,374 463 120,474

झटपट तुलना

तुलना जोडी बदला