নেভিগেশন
AI BENCHY
Advertise here

Claude Opus 5 vs OpenAI: GPT-5.6 Luna

GPT-5.6 Luna (high) average score-এ এগিয়ে: 7.7 vs 7.5. GPT-5.6 Luna (high)-এর benchmark খরচ কম: $1.017 vs $1.550. Claude Opus 5 দ্রুত: 7.60s vs 18.68s, pass rates 57.6% vs 72.7%.

প্রস্তাবিত মডেলGPT-5.6 Luna (high)It has the best score here (7.7), while costing about 1.5x less than Claude Opus 5.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

মেট্রিক Claude Opus 5 Claude Opus 5 none প্রকাশ: 2026-07-25 GPT-5.6 Luna GPT-5.6 Luna high প্রকাশ: 2026-07-09
স্কোর 7.5 7.7
র‍্যাঙ্ক #59 #51
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.6 8.9
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 57.6% 72.7%
অস্থির টেস্ট 1 3
মোট রান 66 66
প্রতি ফলাফলে খরচ 12.912 6.780
মোট খরচ $1.550 $1.017
ইনপুট মূল্য $5.000 / 1M $1.000 / 1M
আউটপুট মূল্য $25.000 / 1M $6.000 / 1M
মোট ইনপুট টোকেন 185,550 80,918
আউটপুট টোকেন 24,866 5,088
রিজনিং টোকেন 0 150,910
প্রতিক্রিয়া সময় (গড়) 7.60s 18.68s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 47.72s 111.09s
প্রতিক্রিয়া সময় (মোট) 167.28s 411.05s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#59 Claude Opus 5

none
খরচ
$0.271
সময়
149.3s
টোকেন
10,962 tok

#51 GPT-5.6 Luna

high
খরচ
$0.033
সময়
34.2s
টোকেন
5,484 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 5 5.9 9.7 33.3% 0 5.54s 10,590 2,886 0
GPT-5.6 Luna 5.5 4.7 55.6% 2 15.63s 7,302 510 17,746

দ্রুত তুলনা

তুলনার জুটি বদলান