নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

OpenAI: GPT-5.6 Luna vs Poolside: Laguna S 2.1

average score প্রায় সমান: 5.4 vs 5.4. Laguna S 2.1 (medium)-এর benchmark খরচ কম: $0.059 vs $0.142. GPT-5.6 Luna দ্রুত: 1.50s vs 58.43s, pass rates 34.9% vs 25.8%.

প্রস্তাবিত মডেলGPT-5.6 LunaIt has the best score here (5.4), while responding about 39.1x faster than Laguna S 2.1 (medium).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-22

মেট্রিক GPT-5.6 Luna GPT-5.6 Luna none প্রকাশ: 2026-07-09 Laguna S 2.1 Laguna S 2.1 medium প্রকাশ: 2026-07-21 বিনামূল্যে উপলভ্য
স্কোর 5.4 5.4
র‍্যাঙ্ক #166 #164
নির্ভরযোগ্যতা 10.0 9.8
ধারাবাহিকতা 8.8 8.4
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 34.9% 25.8%
অস্থির টেস্ট 3 4
মোট রান 66 66
প্রতি ফলাফলে খরচ 2.360 1.451
মোট খরচ $0.142 $0.059
ইনপুট মূল্য $1.000 / 1M $0.100 / 1M
আউটপুট মূল্য $6.000 / 1M $0.200 / 1M
মোট ইনপুট টোকেন 101,323 86,641
আউটপুট টোকেন 6,709 97,298
রিজনিং টোকেন 0 242,297
প্রতিক্রিয়া সময় (গড়) 1.50s 58.43s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 10.57s 560.31s
প্রতিক্রিয়া সময় (মোট) 32.91s 1285.48s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#166 GPT-5.6 Luna

none
খরচ
$0.016
সময়
15.8s
টোকেন
2,685 tok

#164 Laguna S 2.1

medium
খরচ
$0.001
সময়
4.0s
টোকেন
867 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.6 Luna 3.8 7.2 22.2% 1 980ms 7,302 459 0
Laguna S 2.1 5.3 7.2 44.4% 1 158.98s 7,917 93,354 106,718

দ্রুত তুলনা

তুলনার জুটি বদলান