AI BENCHY
Advertise here

#148

Trinity Large Preview

Arcee AI रिलीज़: 2026-01-27 परीक्षण किया गया: 2026-05-22 00:42 arcee-ai/trinity-large-preview::none

संगति

9.3

कुल लागत (वर्तमान कीमत)

$0.008 ↑ +1047.8%

परीक्षण के समय: $0.001

कुल आउटपुट टोकन

2,169

कुल इनपुट टोकन

29,828

इनपुट कीमत

$0.243 / 1M

आउटपुट कीमत

$0.243 / 1M

सही परीक्षण

गलत टेस्ट: 16

प्रति प्रयास पास दर: 23.3%

अस्थिर टेस्ट

2

अस्थिर टेस्ट में रनों के बीच मिले-जुले परिणाम रहे (कम से कम एक पास और एक फेल)।

प्रतिक्रिया समय (औसत)

2.98s

प्रतिक्रिया समय (अधिकतम): 14.34s

प्रतिक्रिया समय (कुल): 56.57s

रन इतिहास

परीक्षण किया गया स्कोर विश्वसनीयता सही परीक्षण कुल लागत तुलना करें
2026-05-22 00:42 सूट बदला गया 4.8 10.0 $0.001 वर्तमान रन
2026-05-08 15:30 सूट बदला गया 4.8 10.0 $0.001 तुलना करें
2026-04-23 10:54 पहला दर्ज रन 5.3 लागू नहीं $0.000 तुलना करें

इस रन में अलग बेंचमार्क सूट इस्तेमाल हुआ था। ऐतिहासिक बदलाव पढ़ते समय सूट बदलाव को ध्यान में रखें।

रन तुलना

रनस्कोरसंगतिविश्वसनीयतासही परीक्षणअस्थिर टेस्टकुल आउटपुट टोकनकुल इनपुट टोकनकुल लागतप्रतिक्रिया समय (औसत)
2026-05-22 00:42 · वर्तमान रन4.79.310.04/2022,16929,828$0.0012.98s
2026-05-08 15:30 · सूट बदला गया4.88.910.04/1932,1900$0.0013.03s
अंतर-0.1+0.40.00-1-21+29828$0.000-54ms

इन दो रन में अलग-अलग बेंचमार्क सूट इस्तेमाल हुए थे, इसलिए अंतर मॉडल बदलाव और सूट बदलाव दोनों को दर्शाते हैं।

कीमत का इतिहास

OpenRouter से इस मॉडल का ऐतिहासिक मूल्य डेटा।

तारीख इनपुट कीमत आउटपुट कीमत
2026-06-03 21:35 $0.243 / 1M $0.243 / 1M

चार्ट

पहले मॉडल चुनें, फिर दूसरा मॉडल क्लिक करके साइड-बाय-साइड पेज खोलें।

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

त्वरित तुलना

श्रेणी विवरण

श्रेणी स्कोर संगति सही परीक्षण
एंटी-एआई ट्रिक्स 3.1 10.0
कोडिंग 4.0 6.6
संयुक्त 3.0 10.0
डेटा पार्सिंग और निष्कर्षण 10.0 10.0
डोमेन-विशिष्ट 5.3 10.0
Samanya Buddhimatta 4.5 10.0
निर्देश पालन 3.5 10.0
पहेली समाधान 3.6 7.7
टूल कॉलिंग 10.0 10.0
सामान्य ज्ञान 3.0 10.0

तुलना किए गए मॉडल