নেভিগেশন
AI BENCHY
Advertise here

Seed-2.0-Code (medium) vs GPT-5.5

average score প্রায় সমান: 6.9 vs 6.9. GPT-5.5-এর benchmark খরচ কম: $0.544 vs $1.049. GPT-5.5 দ্রুত: 2.36s vs 93.60s, pass rates 71.2% vs 56.1%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-08-12

র‍্যাঙ্ক
#124
মোট আউটপুট টোকেন
336,696
প্রতিক্রিয়া সময় (গড়)
93.60s
মোট খরচ
$1.049
র‍্যাঙ্ক
#126
মোট আউটপুট টোকেন
4,915
প্রতিক্রিয়া সময় (গড়)
2.36s
মোট খরচ
$0.544
প্রস্তাবিত মডেল GPT-5.5

It has the best score here (6.9), while costing about 1.9x less than Seed-2.0-Code (medium).

বিস্তারিত তুলনা

মেট্রিক Seed-2.0-Code Seed-2.0-Code medium প্রকাশ: 2026-08-12 GPT-5.5 GPT-5.5 none প্রকাশ: 2026-04-24
স্কোর 6.9 6.9
র‍্যাঙ্ক #124 #126
নির্ভরযোগ্যতা 4.7 10.0
ধারাবাহিকতা 6.7 8.9
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 71.2% 56.1%
অস্থির টেস্ট 9 3
মোট রান 66 66
প্রতি ফলাফলে খরচ 10.482 4.945
মোট খরচ $1.049 $0.544
ইনপুট মূল্য $0.500 / 1M $5.000 / 1M
আউটপুট মূল্য $3.000 / 1M $30.000 / 1M
মোট ইনপুট টোকেন 76,027 79,285
আউটপুট টোকেন 7,268 4,915
রিজনিং টোকেন 329,428 0
প্রতিক্রিয়া সময় (গড়) 93.60s 2.36s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 626.58s 12.24s
প্রতিক্রিয়া সময় (মোট) 2059.27s 51.88s
প্যারামিটার ~200B মোট (~20B সক্রিয়) ~1.5T মোট (~100B সক্রিয়)
উপলভ্যতা বন্ধ উৎস বন্ধ উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#124 Seed-2.0-Code

medium
খরচ
$0.026
সময়
122.8s
টোকেন
8,630 tok

#126 GPT-5.5

none
খরচ
$0.090
সময়
54.3s
টোকেন
3,063 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Seed-2.0-Code 8.9 7.8 88.9% 1 89.94s 8,247 496 44,062
GPT-5.5 5.5 10.0 33.3% 0 1.35s 7,305 462 0

দ্রুত তুলনা

তুলনার জুটি বদলান