নেভিগেশন
AI BENCHY
Advertise here

GPT-5.6 Terra (medium) vs Qwen3.8 27B (medium)

GPT-5.6 Terra (medium) average score-এ এগিয়ে: 7.8 vs 7.8. স্থানীয় হার্ডওয়্যারের খরচ মাপা হয়নি, তাই খরচের তুলনা পাওয়া যায় না। GPT-5.6 Terra (medium) দ্রুত: 6.85s vs 33.05s, pass rates 69.7% vs 66.7%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-08-15

র‍্যাঙ্ক
#66
মোট আউটপুট টোকেন
30,349
প্রতিক্রিয়া সময় (গড়)
6.85s
মোট খরচ
$0.262
র‍্যাঙ্ক
#68
মোট আউটপুট টোকেন
136,162
প্রতিক্রিয়া সময় (গড়)
33.05s
মোট খরচ
প্রযোজ্য নয়
প্রস্তাবিত মডেল GPT-5.6 Terra (medium)

It has the best score here (7.8), while responding about 4.8x faster than Qwen3.8 27B (medium).

বিস্তারিত তুলনা

মেট্রিক GPT-5.6 Terra GPT-5.6 Terra medium প্রকাশ: 2026-07-09 Qwen3.8 27B Qwen3.8 27B medium প্রকাশ: 2026-08-14
স্কোর 7.8 7.8
র‍্যাঙ্ক #66 #68
নির্ভরযোগ্যতা 10.0 9.6
ধারাবাহিকতা 9.3 9.7
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 69.7% 66.7%
অস্থির টেস্ট 2 1
মোট রান 66 66
প্রতি ফলাফলে খরচ 4.603 প্রযোজ্য নয়
মোট খরচ $0.262 প্রযোজ্য নয়
ইনপুট মূল্য $1.000 / 1M প্রযোজ্য নয়
আউটপুট মূল্য $6.000 / 1M প্রযোজ্য নয়
মোট ইনপুট টোকেন 79,184 98,266
আউটপুট টোকেন 4,878 1,861
রিজনিং টোকেন 25,471 134,301
প্রতিক্রিয়া সময় (গড়) 6.85s 33.05s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 41.68s 214.63s
প্রতিক্রিয়া সময় (মোট) 150.65s 694.04s
প্যারামিটার ~1T মোট (~60B সক্রিয়) 27.3B
উপলভ্যতা বন্ধ উৎস ওজন উপলভ্য

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#66 GPT-5.6 Terra

medium
খরচ
$0.035
সময়
16.3s
টোকেন
2,418 tok

#68 Qwen3.8 27B

medium
খরচ
প্রযোজ্য নয়
সময়
43.4s
টোকেন
2,956 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.6 Terra 6.1 7.2 55.6% 1 7.19s 7,302 427 4,527
Qwen3.8 27B 10.0 10.0 100.0% 0 40.50s 7,893 585 26,808

দ্রুত তুলনা

তুলনার জুটি বদলান

Claude Opus 4.8lowvsQwen3.8 27BmediumSeed-2.0-CodelowvsQwen3.8 27BmediumGPT-5.6 TerramediumvsQwen3.8 27BlowClaude Opus 4.8lowvsGPT-5.6 TerramediumGPT-5.6 TerramediumvsQwen3.7 FlashhighKimi K3maxvsGPT-5.6 TerramediumSeed-2.0-CodelowvsGPT-5.6 TerramediumDeepSeek V4 ProhighvsQwen3.8 27BmediumGPT-5.2 ChatnonevsQwen3.8 27BmediumDeepSeek V4 Flash 0423highvsQwen3.8 27BmediumKimi K3maxvsQwen3.8 27BmediumGPT-5.6 TerramediumvsGLM 5.2high