নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Claude Opus 5 vs OpenAI: GPT-5.6 Luna

average score প্রায় সমান: 7.5 vs 7.6. GPT-5.6 Luna (medium)-এর benchmark খরচ কম: $0.352 vs $1.550. GPT-5.6 Luna (medium) দ্রুত: 7.28s vs 7.60s, pass rates 57.6% vs 65.2%.

প্রস্তাবিত মডেলGPT-5.6 Luna (medium)It has the best score here (7.6), while costing about 4.4x less than Claude Opus 5.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

মেট্রিক Claude Opus 5 Claude Opus 5 none প্রকাশ: 2026-07-25 GPT-5.6 Luna GPT-5.6 Luna medium প্রকাশ: 2026-07-09
স্কোর 7.5 7.6
র‍্যাঙ্ক #59 #57
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.6 9.6
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 57.6% 65.2%
অস্থির টেস্ট 1 1
মোট রান 66 66
প্রতি ফলাফলে খরচ 12.912 2.513
মোট খরচ $1.550 $0.352
ইনপুট মূল্য $5.000 / 1M $1.000 / 1M
আউটপুট মূল্য $25.000 / 1M $6.000 / 1M
মোট ইনপুট টোকেন 185,550 89,676
আউটপুট টোকেন 24,866 5,699
রিজনিং টোকেন 0 37,980
প্রতিক্রিয়া সময় (গড়) 7.60s 7.28s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 47.72s 29.85s
প্রতিক্রিয়া সময় (মোট) 167.28s 160.27s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#59 Claude Opus 5

none
খরচ
$0.271
সময়
149.3s
টোকেন
10,962 tok

#57 GPT-5.6 Luna

medium
খরচ
$0.014
সময়
14.6s
টোকেন
2,362 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 5 5.9 9.7 33.3% 0 5.54s 10,590 2,886 0
GPT-5.6 Luna 5.4 7.2 44.4% 1 10.38s 7,302 564 9,928

দ্রুত তুলনা

তুলনার জুটি বদলান