নেভিগেশন
AI BENCHY
Advertise here

GPT-5.6 Luna vs Inkling Small

average score প্রায় সমান: 5.4 vs 5.3. GPT-5.6 Luna-এর benchmark খরচ কম: $0.015 vs $0.058. GPT-5.6 Luna দ্রুত: 1.50s vs 1.51s, pass rates 34.9% vs 24.2%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-08-01

র‍্যাঙ্ক
#184
মোট আউটপুট টোকেন
6,709
প্রতিক্রিয়া সময় (গড়)
1.50s
মোট খরচ
$0.015
র‍্যাঙ্ক
#187
মোট আউটপুট টোকেন
8,770
প্রতিক্রিয়া সময় (গড়)
1.51s
মোট খরচ
$0.058
প্রস্তাবিত মডেল GPT-5.6 Luna

It has the best score here (5.4), while costing about 4.1x less than Inkling Small.

বিস্তারিত তুলনা

মেট্রিক GPT-5.6 Luna GPT-5.6 Luna none প্রকাশ: 2026-07-09 Inkling Small Inkling Small none প্রকাশ: 2026-08-01
স্কোর 5.4 5.3
র‍্যাঙ্ক #184 #187
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.8 9.6
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 34.9% 24.2%
অস্থির টেস্ট 3 1
মোট রান 66 66
প্রতি ফলাফলে খরচ 2.360 1.158
মোট খরচ $0.015 $0.058
ইনপুট মূল্য $0.100 / 1M $0.500 / 1M
আউটপুট মূল্য $0.601 / 1M $1.200 / 1M
মোট ইনপুট টোকেন 101,323 94,724
আউটপুট টোকেন 6,709 8,770
রিজনিং টোকেন 0 0
প্রতিক্রিয়া সময় (গড়) 1.50s 1.51s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 10.57s 12.35s
প্রতিক্রিয়া সময় (মোট) 32.91s 33.27s

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#184 GPT-5.6 Luna

none
খরচ
$0.016
সময়
15.8s
টোকেন
2,685 tok

#187 Thinking Machines: Inkling Small

none
খরচ
$0.008
সময়
42.1s
টোকেন
6,319 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.6 Luna 3.8 7.2 22.2% 1 980ms 7,302 459 0
Inkling Small 3.6 10.0 0.0% 0 759ms 7,356 454 0

দ্রুত তুলনা

তুলনার জুটি বদলান