নেভিগেশন
AI BENCHY
Advertise here

Trinity Large Preview vs OpenAI: GPT-5.6 Luna

GPT-5.6 Luna average score-এ এগিয়ে: 5.4 vs 4.8. Trinity Large Preview-এর benchmark খরচ কম: $0.008 vs $0.142. GPT-5.6 Luna দ্রুত: 1.50s vs 2.98s, pass rates 21.2% vs 34.9%.

প্রস্তাবিত মডেলTrinity Large PreviewIts score stays close to the best score here (4.8 vs 5.4), while costing about 18.3x less than GPT-5.6 Luna.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-18

মেট্রিক Trinity Large Preview Trinity Large Preview none প্রকাশ: 2026-01-27 GPT-5.6 Luna GPT-5.6 Luna none প্রকাশ: 2026-07-09
স্কোর 4.8 5.4
র‍্যাঙ্ক #179 #155
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.9 8.8
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 21.2% 34.9%
অস্থির টেস্ট 2 3
মোট রান 63 66
প্রতি ফলাফলে খরচ 0.017 2.360
মোট খরচ $0.008 $0.142
ইনপুট মূল্য $0.243 / 1M $1.000 / 1M
আউটপুট মূল্য $0.243 / 1M $6.000 / 1M
মোট ইনপুট টোকেন 29,828 101,323
আউটপুট টোকেন 2,169 6,709
রিজনিং টোকেন 0 0
প্রতিক্রিয়া সময় (গড়) 2.98s 1.50s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 14.34s 10.57s
প্রতিক্রিয়া সময় (মোট) 56.57s 32.91s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#179 Trinity Large Preview

none
No endpoints found for arcee-ai/trinity-large-preview:free.
খরচ
$0.000
সময়
0.0s
টোকেন
0 tok

#155 GPT-5.6 Luna

none
খরচ
$0.016
সময়
15.8s
টোকেন
2,685 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Trinity Large Preview 3.7 7.7 11.1% 1 14.34s 738 397 0
GPT-5.6 Luna 3.8 7.2 22.2% 1 980ms 7,302 459 0

দ্রুত তুলনা

তুলনার জুটি বদলান