নেভিগেশন
AI BENCHY
Advertise here

Anthropic: Claude Opus 4.6 vs OpenAI: GPT-5.6 Terra

GPT-5.6 Terra (medium) average score-এ এগিয়ে: 7.8 vs 7.7. GPT-5.6 Terra (medium)-এর benchmark খরচ কম: $0.676 vs $3.059. GPT-5.6 Terra (medium) দ্রুত: 7.11s vs 34.27s, pass rates 63.6% vs 69.7%.

প্রস্তাবিত মডেলGPT-5.6 Terra (medium)It has the best score here (7.8), while costing about 4.5x less than Claude Opus 4.6 (medium).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

মেট্রিক Claude Opus 4.6 Claude Opus 4.6 medium প্রকাশ: 2026-02-05 GPT-5.6 Terra GPT-5.6 Terra medium প্রকাশ: 2026-07-09
স্কোর 7.7 7.8
র‍্যাঙ্ক #50 #46
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.8 9.3
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 63.6% 69.7%
অস্থির টেস্ট 3 2
মোট রান 66 66
প্রতি ফলাফলে খরচ 23.524 4.825
মোট খরচ $3.059 $0.676
ইনপুট মূল্য $5.000 / 1M $2.500 / 1M
আউটপুট মূল্য $25.000 / 1M $15.000 / 1M
মোট ইনপুট টোকেন 108,615 79,175
আউটপুট টোকেন 72,286 4,878
রিজনিং টোকেন 28,315 26,952
প্রতিক্রিয়া সময় (গড়) 34.27s 7.11s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 151.51s 41.68s
প্রতিক্রিয়া সময় (মোট) 513.99s 156.42s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#50 Claude Opus 4.6

medium
অবৈধ SVG
খরচ
$0.000
সময়
300.0s
টোকেন
0 tok

#46 GPT-5.6 Terra

medium
খরচ
$0.035
সময়
16.3s
টোকেন
2,418 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.6 5.7 7.1 44.4% 1 30.10s 8,522 13,057 4,121
GPT-5.6 Terra 6.1 7.2 55.6% 1 7.19s 7,302 427 4,527

দ্রুত তুলনা

তুলনার জুটি বদলান