নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-5.2 (medium) vs Inkling Small (high)

average score প্রায় সমান: 8.4 vs 8.4. Inkling Small (high)-এর benchmark খরচ কম: $0.416 vs $0.951. GPT-5.2 (medium) দ্রুত: 22.62s vs 31.70s, pass rates 72.7% vs 69.7%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-08-01

র‍্যাঙ্ক
#29
মোট আউটপুট টোকেন
54,782
প্রতিক্রিয়া সময় (গড়)
22.62s
মোট খরচ
$0.951
র‍্যাঙ্ক
#30
মোট আউটপুট টোকেন
310,388
প্রতিক্রিয়া সময় (গড়)
31.70s
মোট খরচ
$0.416
প্রস্তাবিত মডেল Inkling Small (high)

It has the best score here (8.4), while costing about 2.3x less than GPT-5.2 (medium).

বিস্তারিত তুলনা

মেট্রিক GPT-5.2 GPT-5.2 medium প্রকাশ: 2025-12-11 Inkling Small Inkling Small high প্রকাশ: 2026-08-01
স্কোর 8.4 8.4
র‍্যাঙ্ক #29 #30
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.5 9.2
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 72.7% 69.7%
অস্থির টেস্ট 4 2
মোট রান 66 66
প্রতি ফলাফলে খরচ 6.791 2.967
মোট খরচ $0.951 $0.416
ইনপুট মূল্য $1.750 / 1M $0.500 / 1M
আউটপুট মূল্য $14.000 / 1M $1.200 / 1M
মোট ইনপুট টোকেন 105,004 85,660
আউটপুট টোকেন 9,914 6,092
রিজনিং টোকেন 44,868 304,296
প্রতিক্রিয়া সময় (গড়) 22.62s 31.70s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 102.93s 122.60s
প্রতিক্রিয়া সময় (মোট) 339.28s 697.30s

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#29 GPT-5.2

medium
খরচ
$0.047
সময়
49.2s
টোকেন
3,396 tok

#30 Thinking Machines: Inkling Small

high
খরচ
$0.006
সময়
34.7s
টোকেন
4,735 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.2 10.0 10.0 100.0% 0 22.73s 7,302 511 11,912
Inkling Small 10.0 10.0 100.0% 0 93.23s 7,374 463 120,474

দ্রুত তুলনা

তুলনার জুটি বদলান