নেভিগেশন
AI BENCHY
Advertise here

OpenAI: GPT-5.6 Luna vs Poolside: Laguna S 2.1

average score প্রায় সমান: 5.4 vs 5.4. Laguna S 2.1 (high)-এর benchmark খরচ কম: $0.127 vs $0.142. GPT-5.6 Luna দ্রুত: 1.50s vs 111.61s, pass rates 34.9% vs 27.3%.

প্রস্তাবিত মডেলGPT-5.6 LunaIt has the best score here (5.4), while responding about 74.6x faster than Laguna S 2.1 (high).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-22

মেট্রিক GPT-5.6 Luna GPT-5.6 Luna none প্রকাশ: 2026-07-09 Laguna S 2.1 Laguna S 2.1 high প্রকাশ: 2026-07-21 বিনামূল্যে উপলভ্য
স্কোর 5.4 5.4
র‍্যাঙ্ক #166 #167
নির্ভরযোগ্যতা 10.0 9.9
ধারাবাহিকতা 8.8 8.1
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 34.9% 27.3%
অস্থির টেস্ট 3 5
মোট রান 66 66
প্রতি ফলাফলে খরচ 2.360 3.153
মোট খরচ $0.142 $0.127
ইনপুট মূল্য $1.000 / 1M $0.100 / 1M
আউটপুট মূল্য $6.000 / 1M $0.200 / 1M
মোট ইনপুট টোকেন 101,323 208,931
আউটপুট টোকেন 6,709 175,588
রিজনিং টোকেন 0 409,276
প্রতিক্রিয়া সময় (গড়) 1.50s 111.61s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 10.57s 1190.11s
প্রতিক্রিয়া সময় (মোট) 32.91s 2455.39s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#166 GPT-5.6 Luna

none
খরচ
$0.016
সময়
15.8s
টোকেন
2,685 tok

#167 Laguna S 2.1

high
খরচ
$0.001
সময়
6.8s
টোকেন
1,389 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.6 Luna 3.8 7.2 22.2% 1 980ms 7,302 459 0
Laguna S 2.1 5.3 7.2 44.4% 1 271.42s 6,496 59,355 151,009

দ্রুত তুলনা

তুলনার জুটি বদলান