নেভিগেশন
Advertise here

Claude Opus 4.8 vs GPT-5.6 Luna (low)

average score প্রায় সমান: 6.9 vs 6.9. GPT-5.6 Luna (low)-এর benchmark খরচ কম: $0.075 vs $2.334. GPT-5.6 Luna (low) দ্রুত: 6.96s vs 7.54s, pass rates 60.9% vs 56.5%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-10-01

তুলনা করা মডেল

র‍্যাঙ্ক
#167
মোট আউটপুট টোকেন
24,343
প্রতিক্রিয়া সময় (গড়)
7.54s
মোট খরচ
$2.334
র‍্যাঙ্ক
#165
মোট আউটপুট টোকেন
28,001
প্রতিক্রিয়া সময় (গড়)
6.96s
মোট খরচ
$0.075
প্রস্তাবিত মডেল GPT-5.6 Luna (low)

It has the best score here (6.9), while costing about 31.5x less than Claude Opus 4.8.

বিস্তারিত তুলনা

মেট্রিক Claude Opus 4.8 Claude Opus 4.8 none প্রকাশ: 2026-05-28 GPT-5.6 Luna GPT-5.6 Luna low প্রকাশ: 2026-07-09
স্কোর 6.9 6.9
র‍্যাঙ্ক #167 #165
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.3 8.3
প্রচেষ্টা 69/69 69/69
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 60.9% 56.5%
অস্থির টেস্ট 2 5
মোট রান 69 69
প্রতি ফলাফলে খরচ 17.953 2.428
মোট খরচ $2.334 $0.075
ইনপুট মূল্য $5.000 / 1M $0.200 / 1M
আউটপুট মূল্য $25.000 / 1M $1.200 / 1M
মোট ইনপুট টোকেন 345,059 202,680
আউটপুট টোকেন 24,343 9,230
রিজনিং টোকেন 0 18,771
প্রতিক্রিয়া সময় (গড়) 7.54s 6.96s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 65.07s 45.74s
প্রতিক্রিয়া সময় (মোট) 173.31s 160.19s
প্যারামিটার ~5T মোট (~500B সক্রিয়) ~400B মোট (~17B সক্রিয়)
উপলভ্যতা বন্ধ উৎস বন্ধ উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#167 Claude Opus 4.8

none
খরচ
$0.053
সময়
22.0s
টোকেন
2,253 tok

#165 GPT-5.6 Luna

low
খরচ
$0.011
সময়
10.2s
টোকেন
1,897 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.8 5.5 10.0 33.3% 0 3.29s 10,590 1,332 0
GPT-5.6 Luna 5.5 10.0 33.3% 0 4.61s 7,302 557 3,535

দ্রুত তুলনা

তুলনার জুটি বদলান