AI BENCHY Compare

Anthropic: Claude Opus 4.7 vs OpenAI: GPT-5.2 Chat

সারাংশ

Claude Opus 4.7 (medium) average score-এ এগিয়ে: 8.7 vs 8.5. GPT-5.2 Chat-এর benchmark খরচ কম: $0.393 vs $0.679. Claude Opus 4.7 (medium) দ্রুত: 4.73s vs 7.13s, pass rates 82.5% vs 74.6%.

প্রস্তাবিত মডেলClaude Opus 4.7 (medium)It has the best score here (8.7), while responding about 1.5x faster than GPT-5.2 Chat.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-14

মেট্রিক	Claude Opus 4.7 Claude Opus 4.7 medium প্রকাশ: 2026-04-16	GPT-5.2 Chat GPT-5.2 Chat none প্রকাশ: 2025-12-11

মেট্রিক	Claude Opus 4.7 Claude Opus 4.7 medium প্রকাশ: 2026-04-16	GPT-5.2 Chat GPT-5.2 Chat none প্রকাশ: 2025-12-11
স্কোর	8.7	8.5
র‍্যাঙ্ক	#16	#22
নির্ভরযোগ্যতা	10.0	10.0
ধারাবাহিকতা	9.6	8.9
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট	82.5%	74.6%
অস্থির টেস্ট	1	3
মোট রান	63	63
প্রতি ফলাফলে খরচ	3.991	2.803
মোট খরচ	$0.679	$0.393
ইনপুট মূল্য	$5.000 / 1M	$1.750 / 1M
আউটপুট মূল্য	$25.000 / 1M	$14.000 / 1M
মোট ইনপুট টোকেন	65,406	34,212
আউটপুট টোকেন	11,858	23,744
রিজনিং টোকেন	2,198	0
প্রতিক্রিয়া সময় (গড়)	4.73s	7.13s
প্রতিক্রিয়া সময় (সর্বোচ্চ)	23.18s	38.52s
প্রতিক্রিয়া সময় (মোট)	94.51s	149.69s

জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#16 Claude Opus 4.7

medium

খরচ: $0.059
সময়: 26.8s
টোকেন: 2,475 tok

#22 GPT-5.2 Chat

none

খরচ: $0.010
সময়: 15.3s
টোকেন: 797 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

বিভাগ:

অ্যান্টি-এআই কৌশল	স্কোর	ধারাবাহিকতা	প্রতি চেষ্টায় পাস রেট	অস্থির টেস্ট	সঠিক টেস্ট	প্রতিক্রিয়া সময় (গড়)	ইনপুট টোকেন	আউটপুট টোকেন	রিজনিং টোকেন
Claude Opus 4.7	8.3	10.0	75.0%	0		1.85s	894	348	0
GPT-5.2 Chat	8.7	7.9	91.7%	1		3.40s	606	1,807	0

কোডিং	স্কোর	ধারাবাহিকতা	প্রতি চেষ্টায় পাস রেট	অস্থির টেস্ট	সঠিক টেস্ট	প্রতিক্রিয়া সময় (গড়)	ইনপুট টোকেন	আউটপুট টোকেন	রিজনিং টোকেন
Claude Opus 4.7	7.6	7.2	77.8%	1		12.96s	10,635	7,629	1,114
GPT-5.2 Chat	8.8	7.8	88.9%	1		9.82s	7,305	6,731	0

সমন্বিত	স্কোর	ধারাবাহিকতা	প্রতি চেষ্টায় পাস রেট	অস্থির টেস্ট	সঠিক টেস্ট	প্রতিক্রিয়া সময় (গড়)	ইনপুট টোকেন	আউটপুট টোকেন	রিজনিং টোকেন
Claude Opus 4.7	10.0	10.0	100.0%	0		21.45s	24,501	2,369	1,084
GPT-5.2 Chat	10.0	10.0	100.0%	0		9.12s	11,019	1,243	0

ডেটা পার্সিং ও নিষ্কাশন	স্কোর	ধারাবাহিকতা	প্রতি চেষ্টায় পাস রেট	অস্থির টেস্ট	সঠিক টেস্ট	প্রতিক্রিয়া সময় (গড়)	ইনপুট টোকেন	আউটপুট টোকেন	রিজনিং টোকেন
Claude Opus 4.7	10.0	10.0	100.0%	0		2.37s	10,533	324	0
GPT-5.2 Chat	10.0	10.0	100.0%	0		3.05s	7,140	980	0

ডোমেইন-নির্দিষ্ট	স্কোর	ধারাবাহিকতা	প্রতি চেষ্টায় পাস রেট	অস্থির টেস্ট	সঠিক টেস্ট	প্রতিক্রিয়া সময় (গড়)	ইনপুট টোকেন	আউটপুট টোকেন	রিজনিং টোকেন
Claude Opus 4.7	7.7	10.0	66.7%	0		1.17s	630	51	0
GPT-5.2 Chat	5.3	10.0	33.3%	0		17.78s	723	7,810	0

Sadharon Buddhimotta	স্কোর	ধারাবাহিকতা	প্রতি চেষ্টায় পাস রেট	অস্থির টেস্ট	সঠিক টেস্ট	প্রতিক্রিয়া সময় (গড়)	ইনপুট টোকেন	আউটপুট টোকেন	রিজনিং টোকেন
Claude Opus 4.7	10.0	10.0	100.0%	0		2.87s	723	256	0
GPT-5.2 Chat	4.4	3.0	33.3%	1		3.20s	477	335	0

নির্দেশনা অনুসরণ	স্কোর	ধারাবাহিকতা	প্রতি চেষ্টায় পাস রেট	অস্থির টেস্ট	সঠিক টেস্ট	প্রতিক্রিয়া সময় (গড়)	ইনপুট টোকেন	আউটপুট টোকেন	রিজনিং টোকেন
Claude Opus 4.7	10.0	10.0	100.0%	0		1.57s	939	114	0
GPT-5.2 Chat	9.8	10.0	100.0%	0		5.51s	660	1,441	0

ধাঁধা সমাধান	স্কোর	ধারাবাহিকতা	প্রতি চেষ্টায় পাস রেট	অস্থির টেস্ট	সঠিক টেস্ট	প্রতিক্রিয়া সময় (গড়)	ইনপুট টোকেন	আউটপুট টোকেন	রিজনিং টোকেন
Claude Opus 4.7	10.0	10.0	100.0%	0		2.43s	939	370	0
GPT-5.2 Chat	7.7	10.0	66.7%	0		4.10s	642	1,603	0

টুল কলিং	স্কোর	ধারাবাহিকতা	প্রতি চেষ্টায় পাস রেট	অস্থির টেস্ট	সঠিক টেস্ট	প্রতিক্রিয়া সময় (গড়)	ইনপুট টোকেন	আউটপুট টোকেন	রিজনিং টোকেন
Claude Opus 4.7	10.0	10.0	100.0%	0		4.17s	15,339	373	0
GPT-5.2 Chat	10.0	10.0	100.0%	0		4.68s	5,445	555	0

সাধারণ জ্ঞান	স্কোর	ধারাবাহিকতা	প্রতি চেষ্টায় পাস রেট	অস্থির টেস্ট	সঠিক টেস্ট	প্রতিক্রিয়া সময় (গড়)	ইনপুট টোকেন	আউটপুট টোকেন	রিজনিং টোকেন
Claude Opus 4.7	3.0	10.0	0.0%	0		2.25s	273	24	0
GPT-5.2 Chat	3.0	10.0	0.0%	0		6.89s	195	1,239	0

দ্রুত তুলনা

তুলনার জুটি বদলান

Seed-2.0-LitemediumvsGPT-5.2 Chatnone GPT-5.2 ChatnonevsStep 3.7 Flashmedium GPT-5.2 ChatnonevsGLM 5medium GPT-5.2 ChatnonevsGrok 4.5medium GPT-5.2 ChatnonevsGLM 5.2medium DeepSeek V4 FlashhighvsGPT-5.2 Chatnone Gemini 2.5 FlashmediumvsGPT-5.2 Chatnone GPT-5.2 ChatnonevsQwen3.7 Plusmedium Claude Opus 4.8mediumvsGPT-5.2 Chatnone Nemotron 3 Ultra 550b A55bmediumবিনামূল্যে উপলভ্যvsGPT-5.2 Chatnone GPT-5.2 ChatnonevsQwen3.6 Max Previewmedium Claude Opus 4.7mediumvsDeepSeek V4 Flashhigh