নেভিগেশন
AI BENCHY
Advertise here

Seed-2.0-Code (high) vs GPT-5.5

average score প্রায় সমান: 6.9 vs 6.9. GPT-5.5-এর benchmark খরচ কম: $0.544 vs $1.312. GPT-5.5 দ্রুত: 2.36s vs 127.79s, pass rates 71.2% vs 56.1%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-08-12

র‍্যাঙ্ক
#123
মোট আউটপুট টোকেন
423,424
প্রতিক্রিয়া সময় (গড়)
127.79s
মোট খরচ
$1.312
র‍্যাঙ্ক
#126
মোট আউটপুট টোকেন
4,915
প্রতিক্রিয়া সময় (গড়)
2.36s
মোট খরচ
$0.544
প্রস্তাবিত মডেল GPT-5.5

It has the best score here (6.9), while costing about 2.4x less than Seed-2.0-Code (high).

বিস্তারিত তুলনা

মেট্রিক Seed-2.0-Code Seed-2.0-Code high প্রকাশ: 2026-08-12 GPT-5.5 GPT-5.5 none প্রকাশ: 2026-04-24
স্কোর 6.9 6.9
র‍্যাঙ্ক #123 #126
নির্ভরযোগ্যতা 6.0 10.0
ধারাবাহিকতা 7.0 8.9
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 71.2% 56.1%
অস্থির টেস্ট 8 3
মোট রান 66 66
প্রতি ফলাফলে খরচ 11.921 4.945
মোট খরচ $1.312 $0.544
ইনপুট মূল্য $0.500 / 1M $5.000 / 1M
আউটপুট মূল্য $3.000 / 1M $30.000 / 1M
মোট ইনপুট টোকেন 81,961 79,285
আউটপুট টোকেন 7,187 4,915
রিজনিং টোকেন 416,237 0
প্রতিক্রিয়া সময় (গড়) 127.79s 2.36s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 675.30s 12.24s
প্রতিক্রিয়া সময় (মোট) 2811.27s 51.88s
প্যারামিটার ~200B মোট (~20B সক্রিয়) ~1.5T মোট (~100B সক্রিয়)
উপলভ্যতা বন্ধ উৎস বন্ধ উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#123 Seed-2.0-Code

high
খরচ
$0.037
সময়
183.6s
টোকেন
12,388 tok

#126 GPT-5.5

none
খরচ
$0.090
সময়
54.3s
টোকেন
3,063 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Seed-2.0-Code 5.9 4.4 66.7% 2 266.74s 6,750 432 124,956
GPT-5.5 5.5 10.0 33.3% 0 1.35s 7,305 462 0

দ্রুত তুলনা

তুলনার জুটি বদলান